#模型行为
共 16 条 · 7 天 3 条 · 30 天 4 条
信息流里打上「模型行为」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月10日
10月8日
10月5日
9月16日
9月6日
8月16日
7月30日
论文09:18
Lottery Tickets Are Not Deployment Tickets:稀疏模型无法无损替换密集模型这篇论文用实验告诉你,即使准确率一样,稀疏模型也不能直接替换密集模型——7-10%的决策会变,部署前得重新验证。
7月15日
7月14日
7月7日
Claude Sonnet 5 上线遭大量用户投诉:唱反调、拒执行、爱说教
如果你受够了总是呛声、还想教你做事的 AI,Claude Sonnet 5 绝对让你体验什么叫叛逆——连基础会计任务都被它当成欺诈案例。
6月11日
Fable 5 调整前沿 LLM 安全措施:拒绝行为将透明化
Fable 5 取消模型撒谎式拒绝,对关注 AI 安全与透明度的开发者是重要信号——直接告知拒绝原因比隐藏更值得信任,建议关注具体实施细节。
模型02:51
AI 模型太友善反而输:Royale 大逃杀实验揭示意外结果这个实验戳破了 AI 模型“越友善越好”的迷思,做 AI 应用设计或智能体开发的团队值得一看——你的模型在对抗场景下可能因为“太礼貌”而输掉。
5月25日
5月18日
5月17日
陶哲轩:LLM背后的数学其实简单,真正谜题是为何有时成功有时失败
陶哲轩点出了AI领域最核心的认知盲区——我们能用简单数学造出强大模型,却无法解释其行为,做AI研究或应用的开发者看完会重新思考“理解”的含义。