#软件工程
共 70 条 · 7 天 3 条 · 30 天 16 条
7月23日
7月22日
7月21日
7月20日
7月19日
7月15日
行业02:33
Armin Ronacher谈软件共享语言与摩擦的价值Simon Willison引用了Armin Ronacher的一段话,提醒我们AI代理时代别过度追求消除摩擦,有些摩擦其实是团队对齐理解的重要机制。
7月3日
6月30日
6月29日
6月24日
6月21日
如何让 AI Agent 生成的代码更可靠:软件工程经验迁移
宝玉分享的实操经验:把传统软件工程的代码审查、测试覆盖、灰度发布等方法用到 AI Agent 上,能少写 bug、少修 bug,适合正在用 Agent 写代码的团队。
6月20日
6月15日
6月12日
论文09:31
指令文件对AI智能体PR的影响:Instructions-as-Code研究做AI辅助开发的团队会发现,指令文件不是写得越多越好——研究揭示了哪些写法真正有效,建议点开看看如何优化你的项目指令。
6月10日
6月8日
6月4日
Augment Code 推出 Cosmos:统一智能体平台,软件团队吞吐量提升 3 倍
软件团队终于有了一个能统一管理多个 AI 智能体的平台,解决了智能体碎片化的问题。做工程管理的团队可以直接参考其 3 倍吞吐量提升的实践,建议点开了解如何编排智能体。
6月2日
OpenAI 模型和 Codex 正式登陆 AWS Bedrock
AWS 用户终于可以在熟悉的云环境中直接调用 OpenAI 模型和 Codex,省去跨平台集成的麻烦。做 AI 应用开发或软件工程自动化的团队,建议关注这个新入口。
5月28日
5月26日
论文11:44
超越摘要:用LLM对代码变更进行结构化标签标注代码审查团队终于有了更智能的辅助——LLM自动标注变更类型(重命名/移动/逻辑修改),比人工逐行看diff高效太多,做代码审查或CI/CD集成的开发者可以直接参考。
5月22日
SWE-Mutation:评估LLM生成测试套件可靠性的新基准
软件工程团队和AI研究者终于有了一个严谨的测试套件质量评估工具——SWE-Mutation能帮你判断LLM生成的测试是否真的可靠,做自动化测试或代码修复的开发者值得关注。
5月21日
Scott Wu 感谢与 Anthropic 深度合作,Claude 驱动的 Devin 让软件工程快 10 倍
Devin 基于 Claude 实现了从辅助到自主编程的跨越,做软件工程的团队值得关注——它可能改变你每天写代码的方式。
5月16日
YC 对话 12 位 DevTool 创始人:AI 智能体现状与软件工程未来
12 位一线 DevTool 创始人亲述智能体趋势和踩坑经验,做开发者工具或 AI 应用的团队看完会有共鸣,建议直接看视频。
5月14日
5月12日
论文19:11
AI Workflow Store:为智能体注入工程鲁棒性该研究直击当前AI智能体可靠性不足的痛点,提出以工程化工作流复用替代即时合成,为构建生产级智能体系统提供了重要思路,对Agent落地高风险场景具有参考价值。