22:25官方账号Nathan Lambert: Interconnects@Nathan Lambert作者反思了AI写作能力,探讨AI模型如何变得更强大。他写了一本AI教科书,并思考AI何时能超越人类写作。文章分析了AI在写作上的进步速度,以及人类作者面临的挑战。作者认为AI在写作方面已接近人类水平,但仍有差距。论文AI写作教科书AI能力推荐理由:作者亲测AI写作,看看AI多久能超越人类写教科书,挺有意思的。原文稍后读已读值得跟进有用关注 AI写作
01:55Gary Marcus@GaryMarcusGary Marcus对Astra的推断有了新证据:他在周末指出,单领域专长不等于其他领域也擅长,Astra写作可能不如解题。Ben Golub回应称,Astra相关文稿的写作低于最佳实践,AI模型在写作和心智理论上还有提升空间。Refine预告将发布相关报告。AI模型AstraRefineGary Marcus2 个信源在谈事件专题推荐理由:Gary Marcus说Astra写作不如解题,Ben Golub同意,Refine要发报告。原文稍后读已读值得跟进有用关注 Astra
10:49orange.ai@oran_geMoonshot AI 的 Kimi K3 在内部写作基准中以 2840 Elo 排名第一,超越 Claude Fable 5。相比前代 Kimi K2.6,排名从第 21 跃升至第 1。每个脚本运行成本约 0.25 美元,比被超越的模型便宜 5 倍。这是首个开放权重模型在该基准登顶。AI模型Kimi K3Claude Fable 5Moonshot AI10 个信源在谈事件专题推荐理由:Moonshot AI 的 Kimi K3 在写作评测上干掉了 Claude Fable 5,成本还低 5 倍,开源模型也能这么强?原文稍后读已读值得跟进有用关注 Kimi K3
11:49向阳乔木@vista8有网友发现,Claude 4.8和GPT 5.5的写作能力不如Claude 4.6系列,怀疑是因为Anthropic和OpenAI过度聚焦编程训练,导致模型在写作任务上退化。该观察引发讨论,核心问题在于为何编程与写作能力无法兼顾,是否存在技术难点。目前尚无官方回应,但反映了用户对模型能力平衡的担忧。AI模型ClaudeGPT写作能力10 个信源在谈事件专题推荐理由:如果你用AI写文章、文案或创意内容,这个现象值得关注——模型在编程上越强,写作可能反而变差,做内容创作的建议点开看看讨论。原文稍后读已读值得跟进有用关注 Claude