7月25日
08:13
08:13orange.ai@oran_ge
评价称Opus 5的智能水平略微超过降智后的Fable 5,且价格保持为Fable 5的一半。OpenAI的开源模型已超过旧版Opus 4.8。Opus 4系列在引领上半年后逐渐退场。评论认为在开源巨浪下,这些模型都将成为浪花。
事件专题

推荐理由:Opus 5干过了降智版的Fable 5,价格还便宜一半,开源模型也追上来了,值得关注这波模型更迭。
06:45
06:45官方账号Perplexity@perplexity_ai
72°
Claude Opus 5 现已在 Perplexity 和 Perplexity Computer 上可用。Perplexity 将其与另外六个模型在 WANDR 基准上进行了评估。Claude Opus 5 表现优于除 Fable 5 外的所有模型,同时成本比这些模型平均低 57%。
事件专题

推荐理由:Perplexity 上了 Claude Opus 5,WANDR 跑分只输 Fable 5,价格还便宜一半多,可以试试。
06:36
03:36
03:36Patrick Loeber@patloeber
79°
Anthropic 推出 Claude Opus 5,官方称其智力水平接近 Fable 5,但定价仅为后者的一半。该模型还降低了提示缓存最低门槛,有助于优化开发者成本。发布同时基础设施建设同步推进,提升了响应效率。
事件专题

推荐理由:Anthropic 新模型 Opus 5 性价比超高,接近 Fable 5 能力但价格砍半,缓存优化也实打实省钱。
02:58
02:58AI SDK@aisdk
72°
Anthropic 发布 Claude Opus 5,这是一款思考型主动型模型,现已通过 AI SDK 可用。其智能水平接近 Fable 5,但价格仅为 Fable 5 的一半。该模型在推理和主动规划等任务上表现突出。
事件专题

推荐理由:Anthropic 的 Claude Opus 5 性能接近 Fable 5,价格却只要一半,想省钱又不想降性能的可以试试。
02:55
02:55官方账号Decoder@Matthias Bastian
74°
Anthropic推出了旗舰模型Claude Opus 5,在编码和知识工作基准上取得高分。该模型在ARC-AGI-3(评估新颖问题解决能力的基准)上达到30.2%,几乎是GPT-5.6 Sol的四倍。其token价格仅为Fable 5的一半。
事件专题

推荐理由:Anthropic的新模型Opus 5在推理和编程上很强,价格只有Fable 5一半,性价比高。
02:53
02:53cat@_catwu
76°
Anthropic 推出 Claude Opus 5,定位为“ thoughtful and proactive”模型。官方宣称其前沿智能水平接近 Fable 5,但价格仅为后者一半。该模型擅长长时间自主工作,适合复杂任务场景。
事件专题

推荐理由:Claude Opus 5 价格只有 Fable 5 的一半,性能差距不大,适合预算有限又想要前沿能力的团队尝试。
02:48
02:48Guillermo Rauch@rauchg
Vercel 宣布 Claude Opus 5 已在其 AI Gateway 平台上可用,并新增快速模式支持。相比前代 Opus 模型,Claude Opus 5 在智能体编程任务和低推理努力级别下的输出质量均有提升。该模型通过 Anthropic 的 API 提供服务,Vercel 用户可直接在 Gateway 中调用。
事件专题

推荐理由:Vercel 把 Claude Opus 5 集成进了 AI Gateway,还加了快速模式,编程和低推理成本场景下比上一代 Opus 更强。想用最新 Claude 写代码的可以试试。
02:38
02:38Alex Albert@alexalbert__
81°
Anthropic发布Claude Opus 5模型,定位为深思熟虑且主动的助手。官方称其智能水平接近Fable 5,但推理成本仅为后者的一半。该模型在x平台由Alex Albert推文首次公开。目前尚未披露具体基准跑分及开放渠道。
事件专题

推荐理由:Anthropic新出的Claude Opus 5,据说能力逼近Fable 5,价格只要一半,性价比很能打。
02:35
02:35Gary Marcus@GaryMarcus
71°
Anthropic 推出 Claude Opus 5,称其智能接近 Fable 5 的水平但定价仅为后者的一半。该模型定位为思考更主动的前沿模型,在多项基准测试中表现接近行业顶尖。这一降价策略延续了 Gary Marcus 2023 年预测的价格战趋势。
事件专题

推荐理由:Anthropic 用半价拿出了接近 Fable 5 的模型,性价比拉满,想省钱又想要顶配可以看看。
02:31
02:31The Rundown AI@therundownai
81°
Anthropic推出了Claude Opus 5,相比前代Claude 4.8有大幅提升。在多个基准测试中,Opus 5击败了竞争对手Fable。其定价仅为Fable的一半,性价比显著。该模型现已通过API提供。
事件专题

推荐理由:Anthropic刚发Claude Opus 5,性能比4.8强不少,还在测试中赢了Fable,价格却只要一半,值得关注。
02:13
02:13Claude@claudeai
82°
Claude Opus 5是Anthropic最新发布的推理模型,定位为深思熟虑且主动的模型。其智能水平接近Fable 5,但价格仅为Fable 5的一半。该模型在复杂推理和主动辅助任务上表现突出,旨在以更低成本提供前沿AI能力。
事件专题

推荐理由:Claude Opus 5用一半价格接近Fable 5的水平,性价比很高,适合希望体验前沿AI但预算有限的用户。
02:11
02:11Claude@claudeai
76°
Opus 5 今日在所有付费计划和 Claude API 上线,定价与 Opus 4.8 相同。它是 Claude Max 的默认模型,也是 Claude Pro 上最强的模型。此外提供 Fast 模式,运行速度约为默认的2.5倍。
事件专题

推荐理由:Anthropic 发了 Opus 5,性能更强但没涨价,还有快2.5倍的加速模式,适合既要速度又要质量的人。
01:57
01:57Alex Albert@alexalbert__
78°
Anthropic 发布 Opus 5 模型,在多个领域提升 token 效率的同时,进一步拉高了智能水平。团队投入大量工作优化该模型,使其在编码任务上表现优于 Fable 5。用户反馈使用体验流畅。
事件专题

推荐理由:Anthropic 新模型 Opus 5,token 更省、智商更高,写代码比 Fable 5 顺手,值得试试。
01:53
01:53官方一手歸藏(guizang.ai)@op7418
Claude Opus 5 已发布,定价与 Opus 4.8 相同。在多项基准测试中,Opus 5 成绩大幅优于 Opus 4.8,并且多数测评成绩高于 Fable 5。官方称其智能接近 Fable 5,但价格为 Fable 5 的一半。用户反馈该模型可用性明显提升。
事件专题

推荐理由:Opus 5 性能强于 4.8,价格不变,还接近 Fable 5 但便宜一半,值得升级。
01:24
01:24elvis@omarsar0
76°
Anthropic推出Claude Opus 5,定价为Fable 5的一半。该模型在token效率上显著改进,接近Fable 5的边界智能水平。它被设计为更主动和善于思考的模型,兼顾前沿能力与成本可负担性。
事件专题

推荐理由:Claude Opus 5价格只有Fable 5的一半,token效率更高,适合想要前沿智能又不想花大钱的用户。
00:35
00:35官方账号Sam Altman@sama
Ethan Mollick 指出 GPT-5.6 Pro(仅聊天机器人可用)是目前最智能的模型。GPT-5.6 Ultra(Codex 中的最佳模型)在困难任务上表现较弱。对于真正难题,排名为:GPT-5.6 Sol Pro > Fable 5 Ultracode > GPT-5.6 Sol Ultra。模型命名令用户困惑。
事件专题

推荐理由:OpenAI 的模型命名越来越绕了,看看 E 教授的实测对比,帮你搞清 GPT-5.6 各版本谁最强。
7月24日
14:08
14:08@koltregaskes@koltregaskes
一篇X帖子要求OpenAI在Codex中提供GPT-5.6 Pro。发帖者指出Ultra并非推理层级,而是使用High推理或混合模式,并运行子智能体而非单一智能体。Claude的Ultracode类似但采用动态工作流。Max是最高推理层级,默认隐藏。
事件专题

推荐理由:OpenAI的Codex缺了GPT-5.6 Pro,而且Ultra和Max的概念容易混淆。看看这位用户怎么说。
10:19
10:19官方账号arXiv cs.AI@Shuqi Lu, Chaofan Li, Kun Luo, Zhang Zhang, Hui Wang, Hongwang Xiao, Zheng Liu, Lei Xiong, Jiahao Wang, Sen Wang, Xiyan Jiang, Wanli Li, Yuyang Hu, Hongjin Qian, Bingyu Yan, Ziyi Xia, Yingxia Shao, Kang Liu, Zhicheng Dou, Di He, Chaozhuo Li, Qiwei Ye, Zhongyuan Wang, Zheng Liu
72°
AREX是一种递归自我改进(RSI)的深度研究代理,设计用于解决需要满足多重约束的复杂检索任务。AREX通过内循环收集证据构建临时答案,外循环逐约束审计答案并启动针对性的后续研究。其核心创新是学习一个自主上下文更新工具,将交互历史压缩为紧凑的改进状态,无需外部模型。AREX在4B密集模型和122B-A10B混合专家模型上实例化,在BrowseComp、WideSearch、DeepSearchQA、HLE等基准上显著优于可比规模基线,与使用更多激活参数的模型竞争。
推荐理由:AREX这篇论文让AI自己递归改进答案,在多个搜索和推理基准上超越了同体量模型,想了解自我优化怎么做可以看看。
06:09
05:38
05:38官方账号Together AI@togethercompute
Kimi K3 模型将于7月27日通过 Together AI 平台上线,用户可在发布当天立即使用其推理服务。该服务支持编程、智能体以及生产负载等场景。Together AI 提供高性能推理基础设施,使开发者能第一时间体验 Kimi K3。
事件专题

推荐理由:Kimi K3 马上就能在 Together AI 上用了,7月27日当天就能跑编程和智能体任务,想抢先体验的快去试试。
01:13
01:13官方账号NVIDIA AI@NVIDIAAI
72°
NVIDIA AI展示使用PrimeIntellect托管RL训练,将Nemotron 3 Nano在数学任务上的准确率从22%提升至91%,总成本低于5美元。工作流程包括基线检查、奖励训练和重新测试,最终输出可下载的LoRA适配器。该方案可通过修改一行代码扩展至Nemotron 3 Super和Ultra。
事件专题

推荐理由:花5美元用托管RL把Nemotron 3 Nano的数学准确率从22%拉到91%,还能一键扩展到更大模型,太实用了!
7月23日
22:37
22:37官方账号LMSYS Org (SGLang)@lmsysorg
81°
Poolside发布Laguna S 2.1模型,总参数量118B,采用稀疏MoE架构,每token仅激活8B参数。模型支持1M上下文窗口,提供思考与非思考两种模式。在Terminal-Bench 2.1上获得70.2%准确率,在SWE-bench Multilingual上达78.5%。官方NVFP4量化版本可运行于单个NVIDIA DGX Spark。模型已在SGLang框架上提供Day-0支持。
事件专题

推荐理由:Poolside的Laguna S 2.1是个118B参数的稀疏MoE模型,只激活8B参数,SWE-bench多语言拿下78.5%,还能跑在单个DGX Spark上,适合长时编程任务。