8月11日
20:25
20:25官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里Qwen团队在X平台回应称,Qwen3.6-27B在智能体编码任务中表现强劲。团队确认下一代Qwen3.8-27B将带来更好性能,但未透露具体发布时间。该消息引发社区关注,原推文获得579次点赞和3.2万次浏览。
推荐理由:阿里官方确认Qwen3.8-27B要来了,说会比3.6更强,做智能体编码的可以蹲一波。
7月22日
06:50
7月9日
16:00
16:00Genspark@genspark_ai
73°
SpaceXAI 发布 Grok 4.5,这是其首个专门针对编码和智能体任务训练的模型。该模型使用 Cursor 进行训练,在保持前沿智能水平的同时,实现了领先的速度和成本效率。目前 Grok 4.5 已在 Genspark AI Chat 中上线。
事件专题

推荐理由:SpaceXAI 出了个专门做编码和智能体的 Grok 4.5,用 Cursor 练的,速度又快又省钱,现在 Genspark 里就能用。
7月2日
7月1日
03:18
6月21日
15:13
6月17日
04:01
6月1日
11:12
11:12OpenRouter@OpenRouterAI
精选76°
MiniMax 发布了 M3 模型,这是首个同时具备编码、智能体与多模态能力的开源权重模型。在 SWE-Bench Pro 上达到 59.0%,Terminal Bench 2.1 上 66.0%,并支持 1M 上下文窗口。模型原生多模态,从零开始训练,权重和技术报告将在约 10 天后公开。API 已上线 platform.minimax.io,并提供 MiniMax Code 工具。
推荐理由:MiniMax M3 把编码、智能体和多模态三个前沿能力打包进一个开源模型,做 AI 应用开发或智能体研究的团队可以直接用 API 体验,值得关注即将开源的权重。
11:07
11:07lmarena.ai@lmarena_ai
精选76°
MiniMax 发布开源权重模型 M3,首次在单一模型中融合编码、智能体与多模态三大前沿能力。在 SWE-Bench Pro 上达到 59.0%,Terminal Bench 2.1 为 66.0%,并支持 1M 上下文长度。模型已上线 Arena 的文本、视觉、文档和代码竞技场,用户可投票评测。权重和技术报告将在约 10 天后公开。

推荐理由:MiniMax M3 把编码、智能体和多模态塞进一个开源模型,做 AI 应用和 Agent 开发的团队可以直接在 Arena 上测效果,省去自己搭环境的时间。
5月20日
09:41
09:41官方账号Demis Hassabis@demishassabis
72°
Google DeepMind 的 Demis Hassabis 宣布推出 Gemini 3.5 Flash 模型,在编码和智能体任务上表现优于上一代 3.1 Pro。该模型速度比前沿模型快 4 倍,在特定场景下可达 12 倍,输出速度高达 800 tokens/秒,成本通常不到一半。目前已在 Antigravity、GeminiApp 等平台可用,后续还将推出 Pro 版本。

推荐理由:做编码和智能体开发的团队终于有了又快又便宜的选择——Gemini 3.5 Flash 速度提升 4 倍、成本减半,建议直接上手试试。
02:56
02:56OpenRouter@OpenRouterAI
83°
Google DeepMind 的 Gemini 3.5 Flash 模型已在 OpenRouter 平台上线。该模型在编码、智能体任务和工具使用方面超越了 Gemini 3.1 Pro,同时保持了 Flash 级别的价格和速度。它支持 100 万 token 上下文窗口、6.5 万 token 最大输出,并具备多模态能力。输入价格为每百万 token 1.50 美元,输出价格为每百万 token 9 美元。

推荐理由:做编码和智能体开发的团队终于有了更便宜且更强的选择——Gemini 3.5 Flash 在关键任务上超越 Pro 系列,价格却只有 Flash 档位,值得立刻在 OpenRouter 上试试。