7月31日
10:38
10:38官方一手arXiv: OpenAI@Danyllo Albuquerque, José Renan, Guillermo Rodríguez, Guillermo Rodríguez, Emanuel Dantas, Ademar França, Mirko Perkusich, Kyller Gorgônio, Angelo Perkusich
精选
一项研究评估了 OpenAI o3 仅凭文本需求生成微服务架构的能力,测试对象为 Bookstore 和 PetClinic 两个系统。少样本提示下服务识别 F1 达 0.97,显著高于零样本的 0.79;通信恢复 F1 从 0.61 提升至 0.82。盲审专家认为少样本输出在模块性、连贯性和合理性上优于零样本。研究者指出结论受限于两个小型系统,不能视为模型无关的普遍证明。
事件专题

推荐理由:OpenAI o3 能直接从需求文档拆出微服务,少样本示例让 F1 从 0.79 涨到 0.97。想用 LLM 做架构设计的可以看这篇。