技巧Agent 与开发者精选17:45改进AI智能体本质是数据挖掘问题LangChain的Viv分享了一套改进智能体的实战思路,核心是用生产数据挖Evals,还给了Harness-PostTrain的开源模型配方。#LangChain#智能体#数据挖掘#Evals官方账号LangChain@LangChainAI原文稍后读已读值得跟进有用关注 LangChain
模型Agent 与开发者官方一手17:57Supabase开源Evals基准:评测Claude Code等编码智能体Supabase开源Evals,用真实任务评估Claude Code等编码智能体,比普通基准更实战#Supabase#Evals#Claude Code#Codex1 个信源在谈事件专题官方一手marktechpost@Michal Sutter2 个信源在谈原文稍后读已读值得跟进有用关注 Supabase
行业多源确认72°03:09Anthropic AI研究产品主管:Evals 是新的 PRDAnthropic 的产品主管亲自聊他们怎么做模型评估,说 Evals 就像新版产品需求文档,对做 AI 产品和模型的朋友很有启发。#Anthropic#Claude#Evals#产品管理10 个信源在谈事件专题Lenny Rachitsky@lennysan11 个信源在谈原文稍后读已读值得跟进有用关注 Anthropic