#编程模型
共 20 条 · 7 天 1 条 · 30 天 2 条
信息流里打上「编程模型」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月10日
10月1日
9月9日
9月6日
9月4日
9月3日
9月2日
8月15日
8月12日
微软发布 MAI-Code-1.1-Flash 编程模型,性能提升价格降至 1/4
微软把编程模型升级了,MAI-Code-1.1-Flash 跑分涨了 22%,价格砍到四分之一,还加了看图能力,用 Copilot 的可以试试。
IT之家原文
8月7日
7月11日
Muse Spark 1.1在Agentic评测中可抗衡GPT-5.5和Opus 4.8
Muse Spark 1.1在Agentic任务上声称能追上GPT-5.5,还能直接用Meta API调用,挺有吸引力。
7月9日
6月12日
Kimi-K2.7-Code 开源,编程与智能体性能大幅提升
Kimi-K2.7-Code 在编程和智能体任务上显著超越前代,且推理更高效,做 AI 编程或智能体开发的团队可以直接通过 API 或 Kimi Code 试用,值得关注。
月之暗面开源 Kimi K2.7 Code 编程模型,预告 6 倍速高速版
Kimi K2.7 Code 在编程场景下 token 消耗降低 30%,做 AI 编程的开发者可以立刻通过 API 体验,高速版下周上线值得关注。
6月10日
Cohere 发布首个开源编程模型 North Mini Code,专为 Agent 编程设计
Cohere 用 30B 参数实现了超越 120B 模型的 Agent 编程能力,做自动化代码修复和多步软件工程的开发者可以直接用起来,效率提升明显。
5月31日
Claude Opus 4.8 登顶 DeepSWE Bench,效率与可靠性领先
Claude Opus 4.8 在 DeepSWE Bench 上以 58% Pass@1 证明了自己是效率与可靠性的标杆,做 AI 编程选型的团队可以把它作为性价比参考。
5月28日
Code as a Weapon:恶意代码请求的共识标注提示库
编程模型的安全风险比通用模型高一个量级——返回的代码可以直接运行成武器。做AI安全评估的团队终于有了经过共识验证的测试集,建议用这个库来检验自家模型的拒绝边界。
5月26日