7月2日
04:41
04:41OpenRouter@OpenRouterAI
精选
Anthropic 在 OpenRouter 上重新部署了 Claude Fable 5 模型。新版本增加了针对网络安全滥用的防护措施。在分类器优化期间,部分代码和调试请求可能临时回退到 Opus 4.8。该推文获得了 206 个赞和 9290 次查看。
事件专题

推荐理由:想用 Claude 但担心安全?Anthropic 这次加了新防护,编程请求可能暂时降级到 Opus 4.8,你可以在 OpenRouter 上体验。
03:06
02:28
01:58
7月1日
22:18
22:18Aadit Sheth@aaditsh
精选73°
Anthropic 恢复 Fable 5 访问,同时推出新模型 Sonnet 5,定价每百万 tokens 2 美元。该价格不到 GPT 5.5 的一半。此前 Fable 5 因出口管制被禁 18 天,期间开发者转向其他模型。Anthropic 希望低价新模型能吸引用户回归。
事件专题

推荐理由:Anthropic 把 Sonnet 5 定价降到 $2/百万 tokens,比 GPT 5.5 便宜一半多,开发者有理由回来了。
16:50
15:17
15:17AI SDK@aisdk
87°
Claude 推出 Claude Sonnet 5,这是其最智能体的 Sonnet 版本。该模型能自主制定计划并使用浏览器、终端等工具,运行自主性达到数月前仅更大更贵模型才能实现的水平。AI SDK 现已支持集成 Sonnet 5,开发者可快速调用其能力。

推荐理由:Claude 新出的 Sonnet 5 能自己调用浏览器和终端干活,比过去更聪明还便宜,AI SDK 直接就能用,赶紧试试。
14:29
14:29官方账号Greg Brockman@gdb
83°
OpenAI 推出 GeneBench-Pro,一个用于评估 AI 在计算生物学中处理判断密集型分析能力的基准。其问题需要人类专家 20-40 小时完成。GPT-5.6 Sol 在该基准上实现了显著提升,标志着模型在混乱生物数据中导航、选择分析路径和做出专业判断方面的进步。
事件专题

推荐理由:OpenAI 搞了个新基准 GeneBench-Pro,专门测模型做复杂生物分析时的判断力,GPT-5.6 Sol 表现很亮眼,比之前强不少。
13:49
11:23
10:27
10:23
10:23官方一手歸藏(guizang.ai)@op7418
美国商务部解除了对 Anthropic 旗下 Claude Fable 5 和 Mythos 5 模型的出口管制,Anthropic 宣布将于次日恢复这两个模型的访问权限。该决定结束了此前因政策限制导致的模型不可用状态。Anthropic 感谢用户的耐心及协助重新部署的合作者。
事件专题

推荐理由:Anthropic 的 Claude Fable 5 和 Mythos 5 模型因出口管制被下架,现在解禁了,明天就能恢复使用。
09:34
09:34Poe@poe_platform
72°
Anthropic的Sonnet 5已在Poe平台上线,具备Opus级别的编码和推理能力,但成本显著降低。Google的Nano Banana 2 Lite以约4秒生成清晰一致图像,成为其最快图像模型。两个模型均可在Poe直接试用。
事件专题

推荐理由:Poe上新了!Anthropic的Sonnet 5编码强还便宜,Google的Nano Banana 2 Lite 4秒出图,快去试试。
09:21
09:21官方账号Google DeepMind@GoogleDeepMind
Google DeepMind 推出 Gemini Omni Flash,支持通过自然语言进行会话视频编辑。该模型可同时引用图片、文本和视频帧,组合多模态输入来操控视频动作。它还能利用真实世界知识,直接连接文字与图形到视频输出。目前已在 Google AI Studio、Gemini API 及 Gemini Enterprise Agent Platform 可用。
推荐理由:Google DeepMind 的新模型 Gemini Omni Flash 能边聊天边剪视频,还能把文字和图片直接变成视频操作,很实用。现在在 Google AI Studio 就能试。
08:52
08:21
08:21OpenRouter@OpenRouterAI
OpenRouter 持续在 GPQA 和 TAU-Bench 上测试多数开放权重模型,并公开发布结果。这些数据用于其 AutoExacto 元基准,该基准默认用于路由工具调用。在最新排名中,Parasail.io 和 Zai_org 位列第一。
事件专题

推荐理由:想知道哪些开放权重模型在 GPQA 和 TAU-Bench 上表现最好?OpenRouter 每周跑分、公开排名,还能帮你选最靠谱的推理服务。
08:12

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。