6月17日
04:19
04:19官方账号Anthropic@AnthropicAI
Anthropic 研究发现,根据提问和词汇判断的领域专家更可能在编程中成功。但中级用户与专家之间的成功率差距相当小。这表明具备领域熟练度就足以在特定领域成功编码。
事件专题

推荐理由:Anthropic 研究告诉你,不用非得是顶尖专家,领域懂行就能用好 AI 写代码,中级用户也能达到差不多的效果。
6月16日
23:58
6月12日
07:08
07:08官方账号Replit@Replit
Replit 在提示输入框旁新增了 Plan Mode 开关,开启后 AI 代理会先提出澄清问题并生成结构化计划,用户审核批准后才开始编码。这能有效避免错误假设被直接转化为代码,适合任何比快速修改更复杂的任务。该功能旨在提升 AI 编程的准确性和可控性,减少返工。
推荐理由:Replit 的 Plan Mode 解决了 AI 编程中「先做再改」的痛点,做复杂项目的开发者可以先用计划模式确认方向,避免代码写一半才发现方向错了。
6月11日
18:02
18:02官方账号Simon Willison@simonw
Simon Willison回顾了三年前ChatGPT Code Interpreter刚推出时的Twitter讨论,认为这是编程智能体的首次亮相。当时人们还未意识到这是智能体的雏形,但如今回看,它预示了AI编程的重大变革。Willison提醒程序员不应忽视这一技术,尽管存在过度炒作,但它是职业发展中不可回避的趋势。
推荐理由:程序员若还在怀疑AI编程的价值,这条回顾会颠覆你的认知——三年前的Code Interpreter已埋下智能体种子,现在不关注可能错过职业转型窗口。
11:22
11:22AI Will@FinanceYF5
有用户使用Claude Fable 5(max)模型,仅通过一次生成就创建了Minecraft的HTML版本,画面还原度高,还自动添加了背景音乐。整个过程花费约30美元。这展示了AI在游戏生成方面的惊人能力,大幅降低了游戏开发的门槛和成本。
事件专题

推荐理由:AI一次生成完整游戏,还带BGM,做游戏原型或创意验证的开发者可以直接省下大量时间,值得点开看看效果。
09:46
09:46AI Will@FinanceYF5
一名被Citadel解雇的量化交易员,凭借记忆中的十年交易逻辑,使用Claude Fable 5在48小时内重建了整套交易算法,并反手做空Citadel,目前已盈利43万美元。他没有带走任何一行代码,完全依靠大脑中的策略框架。这一事件展示了AI辅助编程在金融领域的强大潜力,也引发了对量化交易策略安全性和AI工具能力的讨论。
事件专题

推荐理由:量化交易者和金融科技从业者值得关注——Claude Fable 5在48小时内复现顶级交易逻辑,证明了AI辅助策略开发的效率革命,做空老东家的故事也让人反思策略保护机制。
6月10日
11:24
11:24AI Will@FinanceYF5
MIT 一项新研究发现,自主 AI 编程代理虽然将代码提交量提升了 180%,但实际软件发布量仅增长了 30%。研究指出,软件生产存在薄弱环节——当人类仍需审查、连接、测试、打包和交付时,更快的代码编写帮助有限。这揭示了 AI 在软件开发中的真实效率瓶颈,提醒团队不要被代码量增长迷惑。

推荐理由:做软件开发的团队别被代码量增长骗了——MIT 这篇研究戳穿了 AI 编程的产出幻觉,建议所有用 AI 写代码的团队点开看看,避免把效率浪费在无效代码上。
6月7日
00:02
00:02rohanpaul_ai@rohanpaul_ai
88°
Anthropic Claude Code负责人Boris Cherny表示,他不再手动提示Claude,而是编写循环让Claude自主执行任务并决定下一步。他认为这是2025年AI工作方式的转变趋势,即从人工提示转向自动化循环。这一观点反映了AI从工具向自主代理的演进,对开发者工作流有深远影响。
事件专题

推荐理由:Boris Cherny的观察揭示了AI编程从手动提示到自动化循环的范式转变,做AI应用或自动化流程的开发者值得思考这一趋势,并尝试调整自己的工作方式。
6月5日
03:12
6月4日
08:15
08:15Stanford AI Lab@StanfordAILab
精选
斯坦福 AI 实验室发布了一段与 John Yang (@jyangballin) 的对话,讨论 ProgramBench 及其在 AI 编程基准测试发展中的位置。Yang 回顾了 AI 编程领域已取得的进展,并展望了未来可能的方向。该对话适合对 AI 编程能力评估感兴趣的开发者和研究者。
推荐理由:想了解 AI 编程基准测试的来龙去脉和未来趋势?John Yang 的分享能帮你理清 ProgramBench 在其中的位置,做 AI 评估或编程工具的团队值得一听。
6月3日