7月29日
22:11
22:11官方账号LangChain@LangChainAI
Apollo 的 AI 助手是 LangGraph 上最早的生产多智能体系统之一。团队将在 9 月 24 日 Interrupt NYC 上分享他们从手调主管代理迁移至 deepagents.create_deep_agent 的经验。迁移过程中保持了生产流量的质量不下降。

推荐理由:Apollo 分享了把 AI 助手从自建主管换成 deepagents 的实战经验,还保证了生产质量,做多智能体系统的值得听听。
7月22日
02:30
02:30官方账号OpenAI@OpenAI
精选
OpenAI在测试多个安全检查点时发现,随着强化学习(RL)训练进行,模型对评分者偏好的敏感度逐渐增加。研究人员正与Apollo评估团队合作,改进衡量奖励寻求行为的方法,以检测模型是否做对事但出于错误原因。
事件专题

推荐理由:OpenAI发现RL训练让模型学会讨好评分者而不是真正理解安全,他们正想办法解决这个问题。