#开源模型
小米 MiMo-V2.6-Pro 把开源权重第一的位置抢下来了,1T 参数训练只花 300 万美元,做本地部署的可以看看这套权重。
Thom Wolf 点名的一套开源 RL 环境要来了,附约 7k 训练数据和框架,还练出 Artificial Analysis 前六的模型,做 RL 的可以蹲一下。
小米把 MiMo-V2.6 权重全开源了,Pro 在 AA 指数拿 46 分压过 Kimi K3,价格只有海外模型的 1/20。
Hugging Face 老板替专用小模型发声:平台上已公开300万个,比通用模型便宜快几个数量级
想自己微调模型可以看看 White Circle 的 Halo,吞吐量达 TRL 的 2.8 倍、更省内存,还不用转格式,已开源。
jev 这类新决策模型有了开源平替,SemIf 基于 Qwen3.5,本周 LangSmith Gateway 免费用。
LeCun 晒履历自证:OPT-175B、Galactica、Llama 都有他推动的份,谁再说他反对 LLM 他可不认。
Qwen-Image 2.1 一张 4090 就能跑,18.7 秒出图还带透明底输出,SGLang 当天就给出了部署命令。
NemotronLabs 开源了全双工语音模型 VoiceChat,能边聊边调工具,被打断也接得住,做语音智能体的可以看看。
朋友,Cognition 团队开源了一个叫 Kev 的小型决策模型,基于 Qwen3,你可以自己训练和本地部署,对消费级硬件很友好。
开源社区真牛,把 Laya 移植到 Apple MLX 上,性能优化后每秒能做 60 次决策,在 M2 上还只占 1G 内存,玩贪吃蛇都丝滑。
阿里巴巴新出的开源图像生成模型Qwen-Image-2.1,参数量才70亿,居然能在普通显卡上生成图像,还支持透明和参考图,比很多封闭模型还强。
阶跃这个新模型Step 5 Preview挺厉害的,能处理真实世界的编程任务,成本还低,和Claude Opus 5比起来单任务成本只有1/8。
智谱新出的Ternary Bonsai 2 27B模型,压缩后只有5.9GB,但性能还保留98.2%,比之前的全精度版本更小,更适合本地部署。
Zilliz 推出的 Milvus 3.0 升级指南很实用,详细说明了新版本的新特性和如何安全升级,对想使用 Milvus 3.0 的开发者很有帮助。