7月2日
05:24
05:24GitHub@github
82°
Anthropic 的 Claude Fable 5(Mythos 模型类首个)已在 GitHub Copilot 中重新启用并全面可用。该模型专为长时间跨度、自主编码和知识工作任务设计。开发者可在 VS Code 或 GitHub Copilot 应用中试用。
事件专题

推荐理由:Anthropic 在 GitHub Copilot 里放了个能自主写代码的 Claude Fable 5,适合处理长期复杂任务,试试看。
6月30日
12:42
12:42官方账号arXiv cs.AI@Jessica Hutchison, Ian Tyler Applebaum, Kenneth Angelikas, Kush Rakesh Patel, Phuoc Nguyen, Antonio Lazaro, Nicholas Rucinski, Rahad Arman Nabid, Stephen MacNeil
研究者提出Clover代码补全工具,记录学生与代码建议的交互(如tab接受、停留时间),并嵌入注意力检查来探测反思性参与。基于文献构建了AI辅助编程的行为交互度量分类法。实验发现,高tab接受率与低注意力检查表现相关,而长时间停留与高注意力检查表现相关。该研究为衡量学生是否批判性评估AI代码建议提供了定量方法。
推荐理由:这篇论文用Clover工具测出学生无脑接受Copilot建议会导致注意力下降,建议看看怎么避免。
6月26日
10:19
10:19官方一手GitHub Blog@Natalie Guevara
精选
GitHub Copilot agentic harness 在多项基准测试中展现优异性能,同时实现领先的 token 效率。该框架支持超过 20 种不同模型,提供灵活的模型选择。评测覆盖多种任务类型,验证了其通用性。
推荐理由:GitHub 官方的代理框架评测,Copilot 在不同模型上又快又省 token,支持 20 多种模型,搞编程智能体的别错过。
6月24日
6月23日
12:34
12:34官方一手arXiv: OpenAI@Haoran Yu, Lifei Liu, Xiaochong Jiang, Yuwen Jia, Su Wang, Pin Qian, Yihang Chen
一项基于AIDev数据集的长达七个月的纵向分析(400名重复审查者,共11,429条审查记录)发现,审查者对AI生成代码的批准率从30.1%上升至36.8%(Wilcoxon符号秩检验p<10^{-6})。随经验增加,批准率累计差距达14.5个百分点。与此同时,行内评论量下降22%(p=0.0014),但审查延迟增加3.5倍。这种模式提示审查者可能因工作负荷而产生习惯性麻木,而非理性信任调整。
事件专题

推荐理由:这篇论文用真实数据告诉你,人类审查AI代码时会越来越松懈——批准率涨了,评论却少了。做AI代码审核的团队应该看看。
6月20日
03:24
6月18日
01:11
01:11GitHub@github
72°
GitHub Copilot app 现已正式可用(GA),作为新的工作中心。用户可在此直接启动下一步任务、并行指挥多个智能体,并完成PR合并。该应用整合了编码协作与项目管理流程,支持在单一界面内完成从构思到部署的完整工作流。
推荐理由:GitHub把Copilot做成了独立App,能边写代码边指挥智能体干不同任务,最后直接在App里合PR,不用切窗口了。
6月12日
06:34
06:34GitHub@github
GitHub 宣布其 Copilot 应用的技术预览版已向所有 Copilot Pro、Pro+、Max、Business 和 Enterprise 用户开放,无需再排队等待。该应用旨在将 AI 编程助手扩展到移动端,方便开发者随时随地进行代码审查和问题解答。此举降低了使用门槛,让更多团队能立即体验移动端 AI 编程能力。
推荐理由:GitHub Copilot 应用终于开放给所有付费用户,移动端编程助手不再是少数人的特权。做开发、用 Copilot 的团队现在可以直接下载体验,不用再等邀请。
6月10日
05:15
05:15官方一手GitHub Blog@Natalie Guevara
GitHub 推出 Copilot CLI 的自定义智能体功能,允许开发者将终端中的一次性提示转化为可重复、可审查的工作流。该功能让 Copilot 理解你的技术栈和团队流程,从而更精准地执行任务。通过自定义智能体,团队可以共享和复用最佳实践,提升开发效率。这对于需要标准化操作流程的团队尤其有用,减少了重复劳动和错误。
推荐理由:GitHub 把 Copilot 从“问一句答一句”升级成“懂你团队流程”的智能体,做 DevOps 或需要标准化终端操作的开发者可以直接用起来,省去反复写相同命令的麻烦。
03:30
03:09
03:09GitHub@github
88°
Anthropic 发布 Mythos 模型系列首款模型 Claude Fable 5,现已通过 GitHub Copilot 全面可用。该模型专为长周期、自主编码和知识工作设计,支持在 VS Code 或 GitHub Copilot 应用中直接使用。这是 Anthropic 新一代模型架构的首次亮相,旨在提升复杂编程任务的自动化水平。
事件专题

推荐理由:长周期自主编码是 AI 编程的下一个战场,Claude Fable 5 让 Copilot 用户能处理更复杂的任务,做大型项目或自动化脚本的开发者值得一试。
6月3日
5月30日
5月29日
02:18
02:18GitHub@github
88°
Anthropic 的 Claude Opus 4.8 现已正式可用,并开始在 GitHub Copilot 中逐步推出。早期测试显示,该模型在代码理解和生成方面相比前代有明显进步,尤其在处理复杂问题和大代码库导航时表现突出。开发者可以直接在 VS Code 或 Copilot CLI 中尝试。这标志着 AI 编程助手在真实开发场景中的能力又向前迈进了一步。
事件专题

推荐理由:Claude Opus 4.8 在复杂代码理解和生成上实现了可感知的提升,做大型项目或维护遗留代码的开发者值得立即在 Copilot 中体验,看看它能否帮你省下调试时间。