Zilliz 推出的 Milvus 3.0 升级指南很实用,详细说明了新版本的新特性和如何安全升级,对想使用 Milvus 3.0 的开发者很有帮助。
#开源模型
Bolt 上开源模型首周,开发者选最快 DeepSeek V4.1 Flash,该版本在 Bolt Forge 中上线,使用量是 DeepSeek V4 Pro 的 10 倍。
Bolt 给 1100 万开发者开放了 GLM 5.3 Flash 等开源模型,使用量提升 50 倍,比 DeepSeek V4 Pro 更快更便宜。
Base Labs 这个新研究团队和 Hugging Face、Goodfire 合作,一起搞开源模型的安全方案,挺有意思的。
小米开源了他们新模型 MiMo-V2.6 的训练细节,能让你了解如何用 RL 构建开源 AI,和之前的方法比,他们把计算、环境和评估都做了更大规模的扩展。
蚂蚁灵波开源了三款 LingBot-World 2.0 模型,其中 Small 版本 1.3B 参数,适合消费级单卡 GPU 使用,个人开发者和小团队也能从本地开始探索。
AllSpark 新出的两个开源搜索代理,基于 Qwen,在工具使用和办公任务上表现不错,比其他开源模型强。
程序员朋友要注意,行业趋势显示 IDE 在衰落,Token 最大化不再被追求,AI 生代码多到没法审查,开源模型能省不少成本。
DeepSeek 新出的 V4.1 Flash 模型,用不对称 MoE 架构,参数量 552B,但只用了 8B 活跃参数处理输入、16B 处理输出,比上一代节省了 3/4 的存储,算力效率更高,还支持多模态,价格也便宜,适合需要高效推理的场景。
Arena 的 CEO 和 Kleiner Perkins 的创始人聊了聊,讲的是开源模型现在多强了,还有中国实验室在 AI 前沿做了什么。
Cohere 推出了个开源翻译模型,叫 North Small Translate,能帮你翻译多种语言,比如英语转西班牙语、法语,而且质量不错。
Hugging Face 要成立新团队专门处理开源模型的安全问题了,这个团队叫 Open Alignment,听起来挺靠谱的。
阿里开源的Qwen3.8-2.4T-A95B模型现在能在AWS SageMaker HyperPod上部署了,教程详细说明了集群配置和量化方法。