07:36官方账号Simon Willison@simonwSimon Willison 在推文中称 Claude Haiku 是他当前最不喜欢的模型。他认为该模型幻觉问题严重,性能已被同价位的 GPT-5.6-Luna 超越。他还指出 Claude Code WebFetch 工具仍在调用 Claude Haiku,导致每次抓取 URL 都可能产生幻觉。该推文获得 196 次点赞和 9928 次浏览。AI模型Claude HaikuGPT-5.6-LunaClaude Code推荐理由:Simon Willison 说 Claude Haiku 幻觉多,不如 GPT-5.6-Luna,还会污染 Claude Code 抓网页,用起来要小心。原文稍后读已读值得跟进有用关注 Claude Haiku
15:14官方账号arXiv cs.LG@Ting-Wen Ko, Jonas Geiping该研究分析了7个LLM在20个争议话题上的双人辩论,发现自对弈轨迹形成模型特定吸引子。在混合对弈中,Claude Haiku作为强吸引子,其他模型会模仿其元评论等特征,而GPT-4.1 nano表现出高度可塑性。这些吸引子使对话行为部分可预测,但受非对称伙伴影响。论文Claude HaikuGPT-4.1 nano多智能体推荐理由:这篇论文发现LLM聊多了会互相带跑偏,Claude Haiku像个引力源,其他模型会被它影响。原文稍后读已读值得跟进有用关注 Claude Haiku