全部动态
AI 相关资讯全量信息流 · 3051 条
7月23日
刘海区实时显示Claude Code与Codex代理进程状态的工具
用这个小工具,MacBook 刘海就能实时显示 Claude Code、Codex 等代理的运行状态,还有吉祥物走动,点开还能看每轮对话的提示词,挺有意思的。
EdgeBench 基准测试教程:分析 AI Agent 任务与评估指标
想看 AI Agent 怎么测?EdgeBench 教程一步步教你下载数据、跑排行榜、分析 scaling law,连代码都给了,直接跟就行。
LangChain 推出 agent 评估技能库,支持 Codex 和 Claude Code
想测你的 agent 好不好用?LangChain 这个新技能库让你直接用 Codex 或 Claude Code 跑 eval 任务,还能自动检查验证器准不准。
Claude for Long-Horizon Tasks 视频教程:智能体四大核心主题
想用Claude做复杂长周期任务?这个教程讲了四个实操要点:脑子跟手分开、加验证器、自己学习记忆、整组织级别控制。别错过。
monday.com 基于 Amazon Bedrock 运行 AI Teammates 实战
monday.com 分享了在 Amazon Bedrock 上跑 AI 智能体的真实数据和架构,开发者可以抄作业提升编码效率。
7月22日
Graph engineering 正流行,但 LangChain 已用它造 Agent 三年了
LangChain 团队用三年实战告诉你,图工程不是新噱头,而是做 agent 的硬核技能,想搞复杂 agent 的可以看看。
Databricks 实测:在数百万行复杂代码库中,到底哪种模型和 Harness 框架性价比最高、用起来最顺手
Databricks 用真实的百万行代码库帮你试了一遍,哪个模型配哪个框架最省钱最好使,直接看结果选就行
Anthropic 公开代码迁移六步法:Bun 百万行从 Zig 搬 Rust
Anthropic 分享了用 Claude Code 把百万行代码从 Zig 搬到 Rust 的六步法,两周搞定,搞代码迁移的可以照搬这个流程。
OpenAI Codex Code Review 新规则:AGENTS.md 让审查召回率从 58% 跃至 98%
OpenAI 给 Codex Code Review 加了 AGENTS.md 规则,能抓住 diff 看不出的破坏性改动,评测召回率从 58% 提到 98%
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档