7月25日
01:53
01:53官方一手歸藏(guizang.ai)@op7418
Claude Opus 5 已发布,定价与 Opus 4.8 相同。在多项基准测试中,Opus 5 成绩大幅优于 Opus 4.8,并且多数测评成绩高于 Fable 5。官方称其智能接近 Fable 5,但价格为 Fable 5 的一半。用户反馈该模型可用性明显提升。
事件专题

推荐理由:Opus 5 性能强于 4.8,价格不变,还接近 Fable 5 但便宜一半,值得升级。
01:31
01:24
01:24elvis@omarsar0
76°
Anthropic推出Claude Opus 5,定价为Fable 5的一半。该模型在token效率上显著改进,接近Fable 5的边界智能水平。它被设计为更主动和善于思考的模型,兼顾前沿能力与成本可负担性。
事件专题

推荐理由:Claude Opus 5价格只有Fable 5的一半,token效率更高,适合想要前沿智能又不想花大钱的用户。
00:35
00:35官方账号Sam Altman@sama
Ethan Mollick 指出 GPT-5.6 Pro(仅聊天机器人可用)是目前最智能的模型。GPT-5.6 Ultra(Codex 中的最佳模型)在困难任务上表现较弱。对于真正难题,排名为:GPT-5.6 Sol Pro > Fable 5 Ultracode > GPT-5.6 Sol Ultra。模型命名令用户困惑。
事件专题

推荐理由:OpenAI 的模型命名越来越绕了,看看 E 教授的实测对比,帮你搞清 GPT-5.6 各版本谁最强。
00:24
00:24elvis@omarsar0
精选
Handoff 发布了 H1 模型,专门用于解析住宅建筑蓝图,能从原始 PDF 自动生成全工种材料清单。在自家基准测试中,H1 得分 81.6%,超过有经验的估算师,且比八个主流 AI 模型高出 30 个百分点以上。该模型体现了垂直 AI 在特定工作流中的优势。
推荐理由:Handoff 的 H1 模型专啃建筑蓝图,自动算材料清单,准确率 81.6%,比八个通用 AI 模型还强。搞施工估算的可以看看。
7月24日
22:57
22:57小互@imxiaohu
Hyper3D Rodin在零件级模型生成基础上,进一步实现可交互动画资产生成。该技术从静态模型直接生成动画资产,降低游戏和动画开发门槛。生成的资产可用于游戏、动画开发与设计制造。
推荐理由:Hyper3D Rodin直接从零件模型生成可交互动画,省掉手动绑定骨骼的功夫,做游戏和动画效率能高不少。
15:51
11:28
11:28官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云发布了最新的语音技术Qwen-Audio-3.0-TTS模型,该模型已在OpenRouter平台上线。该模型支持更自然、更具表现力的语音合成,可用于提升音频交互体验。开发者可以通过OpenRouter API直接调用该模型,无需自行部署。
推荐理由:阿里云新出的Qwen-Audio-3.0-TTS模型在OpenRouter上就能用,语音听起来更自然,做语音交互的可以试试。
06:30
06:30官方账号Nous Research@NousResearch
精选
蚂蚁集团(AntLingAGI)发布新MoE模型Ling-3.0-flash,总参数124B,激活参数5.1B,运行速度快。该模型专为智能体工作负载设计,涵盖编码、搜索、研究和工具使用场景。即日起一周内,用户可通过Nous Portal免费使用。

推荐理由:蚂蚁发了新MoE模型Ling-3.0-flash,124B参数但只激活5.1B,跑得快,还免费一周。适合搞智能体、编码或搜索任务,快去体验。
06:09
05:38
05:38官方账号Together AI@togethercompute
Kimi K3 模型将于7月27日通过 Together AI 平台上线,用户可在发布当天立即使用其推理服务。该服务支持编程、智能体以及生产负载等场景。Together AI 提供高性能推理基础设施,使开发者能第一时间体验 Kimi K3。
事件专题

推荐理由:Kimi K3 马上就能在 Together AI 上用了,7月27日当天就能跑编程和智能体任务,想抢先体验的快去试试。
03:11
03:10
03:07
03:06
03:06Paul Couvert@itsPaulAi
Offloop团队推出D1层,一个仅3B参数的多智能体路由层。它在GDPval基准上达到SOTA,领先Claude Code和Codex,覆盖美国年收入2.4万亿美元的岗位需求。D1自动决定每个步骤由哪个智能体执行,替代手动比较多个agent输出。
事件专题

推荐理由:Offloop搞了个D1路由层,3B参数就能自动调度多个AI agent,基准上干掉了Claude Code和Codex,挺有意思。
02:51
02:51OpenRouter@OpenRouterAI
微软AI在OpenRouter平台发布两个新模型。MAI-Image-2.5-Pro是其目前为止最高保真度的图像生成模型。MAI-Voice-2-Flash专为高容量、实时语音交互场景设计。两个模型现已可通过OpenRouter API调用。
事件专题

推荐理由:微软新模型上线OpenRouter,图像更清晰,语音更实时,适合开发者和创作者试玩。
02:50
02:50OpenRouter@OpenRouterAI
OpenRouter 上线了微软的 MAI-Voice-2-Flash 模型,相比前代 MAI-Voice-2 推理速度提升2倍。该模型支持15种语言,保持自然韵律和声学质量,并提供细粒度语调控制。专为响应式语音助手和实时交互场景设计。
推荐理由:需要更快更自然的语音合成?微软新模型速度快两倍,15种语言随意切换,适合搭实时语音Agent。
02:49
01:20
01:20Mustafa Suleyman@mustafasuleyman
72°
微软发布MAI-Voice-2-Flash,相比MAI-Voice-2推理速度快2倍。定价为每100万字符15美元,成本降低32%。该模型已集成到Dynamics 365 Contact Center,可为呼叫中心减少高达89%的GPU成本。目前处于公开预览阶段。
推荐理由:微软新语音模型MAI-Voice-2-Flash,跑得快还便宜32%,支撑企业呼叫中心,GPU成本能砍89%。
01:19
01:19Mustafa Suleyman@mustafasuleyman
MAI-Image-2.5-Pro 今日在 Foundry 平台开放预览。这是微软最高保真度的专业级图像模型,支持高质量图像生成、精细编辑以及精确的图内文本渲染。该模型加入图像系列,开发者可根据质量、速度和成本选择适合的模型。
事件专题

推荐理由:微软推出 MAI-Image-2.5-Pro 预览版,生成图像质量最高,还能精准渲染文字,适合专业场景。
01:13
01:13官方账号NVIDIA AI@NVIDIAAI
72°
NVIDIA AI展示使用PrimeIntellect托管RL训练,将Nemotron 3 Nano在数学任务上的准确率从22%提升至91%,总成本低于5美元。工作流程包括基线检查、奖励训练和重新测试,最终输出可下载的LoRA适配器。该方案可通过修改一行代码扩展至Nemotron 3 Super和Ultra。
事件专题

推荐理由:花5美元用托管RL把Nemotron 3 Nano的数学准确率从22%拉到91%,还能一键扩展到更大模型,太实用了!

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。