7月25日
05:13
05:13官方一手Anthropic: Newsroom资讯
72°
Anthropic于2026年7月24日发布Claude Opus 5。Opus 5是Opus层级的阶跃式改进,主要增强了对长时间运行代理的支持。该模型在编码和专业工作场景中也实现了性能提升。
事件专题

推荐理由:Anthropic刚出Claude Opus 5,专门优化了长时间跑智能体,写代码和做专业工作都比上一代强。
7月1日
03:47
03:47官方一手Google Research: Blog资讯
Google Earth AI团队将Heat Resilience数据集的覆盖范围扩大到全球50多个城市。该数据集采用开源模型与数据集许可,提供高分辨率城市热环境指标。社区可利用该数据评估城市热岛效应,制定适应性措施。
事件专题

推荐理由:Google把热弹性数据做到50+城市了,开源可下载,做城市热岛分析直接拿数据,不用自己算。
5月14日
00:33
5月13日
21:36
21:36官方一手Anthropic: Engineering资讯
Anthropic 发布了一篇关于托管智能体(Managed Agents)的工程博客,提出将智能体的“大脑”(规划与推理)与“手”(执行工具)解耦的架构设计。这种架构允许更灵活地扩展智能体能力,同时降低复杂度和成本。文章详细介绍了如何通过托管智能体实现更可靠、可维护的自动化系统。这对于构建大规模 AI 自动化系统的开发者具有重要参考价值。
事件专题

推荐理由:Anthropic 把智能体架构的瓶颈点拆开了——大脑和手解耦后,做复杂自动化系统的团队可以更灵活地扩展能力,建议做 AI 智能体开发的直接点开看架构细节。
21:35
21:35官方一手MiniMax: News资讯
MiniMax 发布了其最新语音模型 Speech 2.8,在语音合成质量、自然度和实时性上均有显著提升。该模型支持多语言、多情感和多种说话风格,能够生成高度逼真的语音。Speech 2.8 在多个基准测试中表现优异,为语音交互、内容创作等场景提供了更强大的工具。
推荐理由:语音合成质量再上台阶,做语音助手、有声内容或虚拟主播的团队可以直接用上更自然的声音,建议体验一下效果。
21:35
21:35官方一手Anthropic: Engineering资讯
75°
Anthropic 宣布其 Claude 3.5 Sonnet 模型在 SWE-bench Verified 基准测试中取得了 49.7% 的通过率,较此前最佳成绩提升了约 10 个百分点。该测试评估 AI 模型解决真实 GitHub 问题的能力,包括代码修复、功能实现等。Claude 3.5 Sonnet 在多个类别中表现优异,尤其在需要多步推理和上下文理解的复杂任务上。这一进展表明 AI 在软件工程自动化领域正快速接近人类水平。
事件专题

推荐理由:Claude 3.5 Sonnet 在 SWE-bench 上的突破意味着 AI 编程助手离真正解决复杂工程问题更近了一步,做软件开发的团队可以关注这一能力提升对日常代码修复和功能开发的潜在影响。
12:33
5月11日
22:17
22:17官方账号百度 AI Baidu@Baidu_Inc
70°
百度发布了其最新基础模型ERNIE 5.1,基于ERNIE 5.0的预训练基础构建。该模型在搜索、推理、知识问答、创意写作和智能体能力上进行了升级,同时预训练成本仅为同类模型的约6%。这一进展可能显著降低大模型的训练门槛。

推荐理由:ERNIE 5.1以极低的预训练成本实现了能力的全面升级,这展示了高效模型优化的潜力,可能对行业降低成本具有示范意义。