6月24日
10:56
00:27
00:27Paul Couvert@itsPaulAi
trylatitude 是一款开源监控工具,可实时追踪 AI Agent 的 Token 消耗与成本。它兼容 Anthropic、OpenAI 等模型,支持监控 Agent 的失败和对话聚类。该工具帮助公司将 Agent 对话数据转化为可分析的资产。
事件专题

推荐理由:cesar.wtf 发了个开源工具 trylatitude,能精确看到你 AI agent 的 token 花在哪了,还兼容 Anthropic 和 OpenAI,比自己写日志好用多了。
6月23日
19:06
19:06官方账号Decoder@Matthias Bastian
精选
OpenAI 通过其 Daybreak 网络安全计划推出了更新版 Codex Security 插件和完整的 GPT-5.5-Cyber 模型,同时宣布与超过 25 家安全公司及多个政府合作。新模型专注于从发现漏洞转向自动修补漏洞。在网络安全基准测试中,GPT-5.5-Cyber 的性能超过了 Anthropic 的 Mythos 模型。
事件专题

推荐理由:OpenAI 新出的 GPT-5.5-Cyber 专攻网络安全,能自动修补漏洞,基准测试里已经跑赢了 Anthropic 的 Mythos。
01:42
01:42官方账号Decoder@Matthias Bastian
美光投资Anthropic的H轮融资,并获得多年期合同,为Claude的基础设施供应内存。Anthropic联合创始人Tom Brown称内存对训练和运行Claude至关重要。批评者认为这种循环交易正在制造泡沫。美光股价在一年内飙升超过十倍。
事件专题

推荐理由:美光投钱还签多年合同帮Claude搞内存,这合作直接关系到Claude性能,有点意思。
6月22日
16:33
16:33官方账号Decoder@Matthias Bastian
Sakana AI推出了Fugu系统,该系统能动态协调多个大型语言模型(如GPT-4、Claude等),在Fable和Mythos基准测试上达到与Anthropic的Fable 5相当的性能。Fugu通过实时路由和模型组合,减少了对单一AI提供商的依赖。测试中,Fugu在Fable基准上得分超过Anthropic的Fable 5,并在Mythos基准上表现出色。
事件专题

推荐理由:日本AI公司Sakana AI搞了个新系统叫Fugu,能让不同模型一起干活,不用只靠一家供应商。效果还跟Anthropic的Fable 5差不多,值得看看怎么做到的。
03:49
6月21日
15:18
07:00
07:00官方一手Claude Code: GitHub Releases@ashwin-ant
Claude Code v2.1.185 将流中断提示从 "No response from API · Retrying in …" 改为 "Waiting for API response · will retry in …"。触发等待提示的静默时间从 10 秒延长到 20 秒。新文字更准确地反映等待原因。
事件专题

推荐理由:Claude Code改了个小细节,提示语更温和,等待时间更长,避免频繁打断你干活。