Anthropic在Databricks上发布了Claude Haiku 5.5,比前代质量提升15%且成本更低,适合需要高性能小模型的开发者。
#小模型
共 27 条 · 7 天 3 条 · 30 天 9 条
信息流里打上「小模型」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月8日
Anthropic发布Claude Haiku 5.5模型
10月7日
9月26日
NaceAI 发布 Drex:亚 6B 参数决策模型,直接输出选项概率
NaceAI 刚发了 Drex,一个小于 6B 的小模型,专门帮智能体做路由和选工具,不写推理文本直接输出每个选项的概率,比用生成式模型省算力。
9月25日
40亿参数本地模型作为候选生成器:机电调试中的外部验收层验证协议
机电调试场景里怎么防大模型编造计划?这篇论文的做法挺有意思:小模型只管提候选,发布权交给外部验证层,21 个伪造计划全被拦下,但也暴露了防不住错误用户答案的短板。
9月24日
FRESH:用异构图记忆让小模型工具调用智能体从失败中学习
小模型跑工具智能体老犯重复调用、提前写入这类错,这篇把失败经验做成异构图记忆来避免,τ-Bench 和 AppWorld 都验证有效,做本地部署的可以看看。
9月22日
Hugging Face CEO Clement Delangue:专用小模型是大机会,平台已有300万个公开模型
Hugging Face 老板替专用小模型发声:平台上已公开300万个,比通用模型便宜快几个数量级
9月21日
9月11日
9月10日
9月2日
8月29日
8月19日
8月6日
6月24日
6月16日
6月12日
Llama小模型训练动力学研究:固定Token预算下性能先升后降
这篇论文戳破了「更多Token=更好模型」的直觉,做小模型训练或资源受限场景的开发者会看到训练轨迹比终点指标更关键,建议点开看看如何用间隔遥测避免白费算力。
6月8日
6.6B 小模型 Mac-1 本地跑 Agent,7GB 内存干翻 Siri
Mac 用户和 Agent 开发者注意了——这个 6.6B 的本地模型用 7GB 内存就实现了云端大模型的 Agent 能力,还自带 487 个原生工具,建议直接下载试试,看能否替代你现在的 Siri 或云端方案。
6月6日
Thousand Token Wood:在3B模型上运行多智能体经济模拟
多智能体系统通常依赖大模型,而该项目用3B模型实现了经济模拟,做AI Agent或资源受限场景的开发者值得一看,可以直接复现或借鉴。
6月5日
行业02:49
Exa CEO 谈检索如何解决 Token 危机:小模型+检索可省 20 倍成本做 AI 应用或代理的团队,如果被 token 成本压得喘不过气,这个思路值得一试——用检索让小模型干大模型的活,省 20 倍成本不是梦。
6月4日
6月3日
6月2日
Neurosymbolic 崛起:800k Transformer 15分钟训练解决数独
神经符号系统终于有了可量化的突破——小模型+符号推理就能碾压纯神经网络,做推理模型和逻辑 AI 的团队值得关注这个方向。
5月27日
5月26日
5月19日
Raven 3.5 专精客服,小模型击败 GPT-5 和 Claude Sonnet
客服团队和语音 AI 开发者可以亲眼看到:小模型专精化路线在延迟和效果上碾压通用大模型,PolyAI 的新工具让 10 分钟部署语音代理成为现实,值得立即关注。
5月14日