如果你在多个大模型间做路由,这个框架能直接优化成本和效果,不用先预测质量,实测在10个基准上超过现有方法,还能兼容新模型。
#大模型
OpenRouter 汇集 400 多个大模型,月处理 100 万亿 token,年收入 5000 万美金,估值 13 亿。现在多家巨头想收购它,看看谁会出手。
华为这次展出业界最大规模的Atlas 950 SuperPoD真机,单柜64卡、最高8192卡互联,专为万亿参数大模型训练打造,效率比传统集群大幅提升。
做产品设计和开发的团队值得关注——Fable 5不再是简单的编码工具,而是能主动思考、有品味的协作伙伴,看完你会重新定义AI在项目中的角色。
Claude Fable 5 的“大模型气味”揭示了当前顶尖模型的取舍——慢、贵但能力惊人。做复杂推理或高难度任务的开发者,值得看看 Willison 的实测感受,判断它是否值得你的预算。
1T 参数模型跑出 1000 TPS 的生成速度,对追求低延迟推理的开发者来说是个值得关注的指标,建议申请试用实测质量。
大模型推理速度的里程碑——1T模型跑出1000+ tokens/s,做实时AI应用和推理优化的团队值得关注,可以直接申请试用体验。
做模型训练或理解 scaling law 的团队值得一读——这篇论文把大模型涌现能力的机制讲清楚了,不是玄学而是容量与干扰的数学问题。
小米高管亲自用自家大模型写高考作文,既展示了Mimo的写作能力,又蹭了高考热点。对AI写作感兴趣的读者可以看看大模型如何理解并完成命题作文,顺便感受一下卢伟冰的幽默自嘲。
LG 大手笔采购 Blackwell GPU 表明 AI 基础设施投入进入新阶段,做模型训练或云服务的团队值得关注这一信号——算力军备竞赛正在加速。
DeepSeek 从「不融资」到「天价融资」的转变,意味着中国 AI 竞争进入新阶段——做模型的人要关注资本如何重塑技术路线,投资者则要评估 500 亿美元估值是否合理。建议点开看融资细节和商业化信号。
做文档翻译或长文本处理的团队终于有了不依赖昂贵 LLM 的上下文建模方案——G^2C-MT 用图结构替代暴力检索,翻译质量提升且成本可控,做 NLP 应用的建议点开看看方法细节。
特朗普政府从「放任」转向「自愿安全评估」,做AI大模型的企业需要关注这个信号——提交模型可获保密保护,不提交也无强制压力,但安全漏洞风险正在倒逼监管。建议AI安全负责人和合规团队点开了解窗口期和参与机制。
低精度训练是降低大模型成本的关键,但数值不稳定常让训练白费。GNMR用轻量控制解决了这个痛点,做大规模训练或量化训练的团队值得关注,可以直接集成到现有流程中。