#开源模型
Liquid AI 开源了两款不吐文字只给结构化判断的小模型,3B 版读图文、600M 版还能读音频,一次前向就出结果,适合做实时决策。
Cloudflare 的 Clef 27B 和 Clef Flash 9B 开源决策模型上了 OpenRouter,输入给文本或图片,直接回带概率的结构化答案,Flash 每百万 token 才 $0.09。
三条推文都叫 looped transformer 但完全是三种方案,选错能烧掉一周训练,这篇用 Nanbeige 4.2 实测数据帮你分清。
Mistral Large 4 预览版冲进 WebDev 榜第45名,价格只有 Claude Opus 4.8 的六分之一,10月底还会开源。
Perplexity 把两个嵌入模型开源了,9B 做索引、0.6B 能跑在手机上,PDF 不用 OCR 直接搜,成绩还挺好。
Perplexity 开源了两个 late-interaction 嵌入模型,文本图像网页一个空间里查,做 RAG 的可以上手试试。
Mistral 放话了:Harvey 那个法律基准 LAB 上,Mistral Large 4 是开源模型里的第一名,做法律 AI 的可以看看。
Mistral 发了 Mistral Large 4,官方演示它能跑通用智能体,自己查资料、走完整个工作流再交出成品,适合想试 agent 工作流的人看看。
有 Intel Arc Pro B70 的朋友可以试试这个开源工具,现在能直接用 vLLM 跑本地模型了,不用折腾命令行。
Mistral 用 3800 张 GPU 干出了别人 10 万张卡 72% 的效果,这算力效率对比挺有意思,看看各家的差距。
上海AI实验室开源的 Intern-Decision 只输出决策结果和概率,0.8B 到 4B 的小模型,做分类打分场景可以试试。
Mistral 的新模型 Mistral Large 4 在 WebDev 榜单一口气从130名冲到45名,价格只有 Claude Opus 4.8 的六分之一,10月底还会开源权重,可以蹲一下。
vLLM 联合 KR Labs 出的 Vela 2.0,一次调用就能做安全检查、领域分类和 PII 识别,四个尺寸可选,Apache-2.0 开源。
xAI 把 Grok API 能做的东西写成了 10 个能直接跑的开源示例,从打电话的语音机器人到 5 美元一支的短片,代码全在 GitHub 上,抄起来很方便。
vLLM 和开源基金会 10 月 16 号在旧金山办 Open Together,搞开源 AI 的可以去看看。
Google DeepMind 把多模态嵌入模型压缩到手机能跑的体积了,纯文本只占约 191MB 内存,还能搜代码和音视频,做端侧 RAG 的可以看看。
Naval 谈了个尖锐观点:文章、代码、美术都能被 AI 复刻,连 Photoshop 都疑似被人反编译喂给 LLM 用 Rust 重写了。适合关心软件护城河的人。
法国 Mistral 放出新旗舰 Large 4,用 4000 块 Grace Blackwell GPU 训了两个月,想追欧洲阵营的可以盯一下。
Google 把 270M 参数的多模态 embedding 模型开源了,手机离线就能搜相册、搜语音,不用传云端,隐私党可以试试。
Google 把 EmbeddingGemma 2 用 Apache 2.0 开源了,做 RAG 存几百万条向量的朋友值得看看这篇讲为什么别用闭源 embedding 的分析。
GitHub 基于上亿条真实 PR 做了个 ReviewBench,能测你的 AI 代码审查工具是不是只会刷评论,自己动手就能跑。