8月7日
04:46
04:46官方账号Perplexity@perplexity_ai
Perplexity发布新子代理Terra,专为复杂目标导向任务设计。在WANDR基准测试中,Terra得分比Sonnet高11分。同时,其运行成本降低了一个数量级。另一款子代理Luna则面向追求速度和成本效益的重复性工作流。

推荐理由:Perplexity出了两个新子代理,Terra跑复杂任务比Sonnet强11分,成本还省十倍,日常活儿可以交给Luna。
7月24日
11:36
11:36IT之家博客/媒体
77°
Anthropic 将 Claude Opus 和 Sonnet 模型纳入语音模式,此前仅 Haiku 支持语音对话。Sonnet 和 Opus 专为复杂问题设计,能给出深入回答并执行任务,例如将对话整理成推介方案或重新安排日历行程。语音模式新增支持法语、德语、西班牙语等 9 种语言。用户可在同一对话中自由切换文字与语音,也能随时更换模型。
事件专题

推荐理由:Anthropic 这次把 Opus 和 Sonnet 的语音模式开了,以前只有 Haiku 能用,现在能跟更强的模型聊复杂问题,还能让它帮你整理方案、改行程,支持多国语言,挺实用的。
7月10日
7月7日
7月4日
18:29
18:28
18:28AI Will@FinanceYF5
一位开发者制作了拨杆式界面,可一键切换Claude的Fable 5挡、Sonnet和Opus模型。该工具免去菜单操作,通过拨杆快速匹配不同任务:Fable 5挡处理复杂问题,Sonnet应对日常工作,Opus用于深度思考。这个界面本身也是用Claude构建的。
推荐理由:这个拨杆工具让你像换挡一样在Claude模型间切换,省去菜单翻找,而且它自己就是Claude写的,挺有意思。
6月18日
09:23
09:23官方一手arXiv: DeepSeek@Zhengxiong Luo, Mehtab Zafar, Dylan Wolff, Abhik Roychoudhury
精选
Code-Augur提出安全规范优先范式,将漏洞检测智能体的隐性假设显式化为安全规范,并通过运行时反证持续细化。在真实项目上,Code-Augur比Claude Mythos等专用模型检测到更多漏洞。它基于Sonnet和DeepSeek等通用LLM构建,发现了22个关键开源项目的新漏洞。该方法通过模糊测试触发断言,揭示漏洞或修正规范,提升检测可信度。
推荐理由:这篇论文让AI漏洞检测不再黑箱——Code-Augur会生成明确的安全假设,再用模糊测试验证,已经在真实项目里挖出22个新漏洞,比专用模型还管用。