全部动态

AI 相关资讯全量信息流 · 17328 条
9月21日
技巧Agent 与开发者多源确认精选09:08
AI Agent Evals 实战 FAQ:先发现失败、再谈评估,700+ 工程师踩坑后的完整方法论

两位作者教了700+工程师,他们发现多数团队从搭平台、接LLM judge、看分数开始,这是错的,应该先手动读100条真实trace,找到失败模式,评估器才会长出来。

事件专题
shao__meng@shao__meng3 个信源在谈原文
Yann LeCun 重申自回归大模型无法实现人类水平 AI

Yann LeCun(深度学习领域权威)重申观点,说当前 LLM 无法实现人类水平 AI,理由很具体,比如推理能力在 token 空间中实现是有限的,自改进方法只适用于特定领域,跨模态能力通常用单独训练的编码器,还有家用机器人或 L4/L5 自动驾驶汽车这些例子,和现在的情况对比很清晰。

官方账号Yann LeCun@ylecun原文

仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档