7月8日
01:39
01:39The Rundown AI@therundownai
精选
DoorDash 发布 DashBench 测试,用 105 个历史代码变更评估 AI 代码审查。双模型架构中,Kimi K2.6 负责快速扫描,Claude Fable 5 深入分析。组合方案捕获 65.2% 的真实问题(全 Anthropic 方案为 53.6%),并抓住 8/10 的关键 bug。成本从每变更 $3.91 降至 $3.81。
事件专题

推荐理由:DoorDash 搞了个新基准,用开源 Kimi K2.6 配合 Claude,更便宜还能多抓 bug,做代码审查的可以试试这个搭配。
7月7日
23:19
23:07
22:26
22:26Recraft@recraftai
Recraft AI 发布了图像生成模型 V4.1,该版本在遵循复杂文本提示方面显著改进。用户可通过自然语言描述生成精确图像,模型支持更多风格控制。在内部测试中,Recraft V4.1 的提示跟随准确率相比 V4 提升约 30%。

推荐理由:Recraft 新出的 V4.1,你跟它说个脑洞描述,它真能画出八九不离十,比之前版本跟提示更紧了。
22:17
22:17Hunyuan@TXhunyuan
腾讯混元发布Hy3模型,已在OpenRouter平台上线,通过Novita Labs提供访问。该模型采用295B MoE架构(21B活跃参数),支持原生256K上下文长度,并提供三种可配置推理模式。Hy3在编码、推理和长上下文任务中表现强劲,并针对智能体工作流进行优化。模型免费使用至7月21日。
推荐理由:腾讯的Hy3模型现在OpenRouter上就能用,295B参数但只激活21B,成本低,还有三种推理模式,做智能体任务很合适,而且免费到7月21号,赶紧试试。
22:16
22:15
17:00
17:00@koltregaskes@koltregaskes
精选
分析显示,前沿模型发布到可本地运行的类似开源模型平均滞后25个月。例如GPT-3到Llama 2 70B约37个月,GPT-4到Gemma 3/Qwen3约2年,Claude 3.5 Sonnet到Gemma 4 31B约21个月。趋势预示当前前沿能力可能在两年后出现在笔记本电脑级模型中。该图表预测Fable/Mythos级模型约2028年中出现。
事件专题

推荐理由:想了解前沿模型多久能变成你能在笔记本上跑的开源版?这篇用GPT-4、Claude 3.5等具体案例算出了平均25个月的滞后,还画了未来预测图。
16:53
16:51
16:51@koltregaskes@koltregaskes
73°
OpenAI 宣布其大型模型 GPT-5.6 Sol 将在 Cerebras 硬件上提供推理服务,速度高达 750 tokens 每秒。官方表示该版本与原始模型“相同”,但可能在上下文窗口大小等参数上有调整。该部署预计显著提升推理效率,适用于高吞吐场景。
事件专题

推荐理由:OpenAI 把 GPT-5.6 Sol 放到 Cerebras 上跑,推理速度飙到 750 tokens/s,比常规部署快很多,适合追求低延迟的场景。
16:50
11:21
08:30
08:30官方一手@OpenAIDevs@OpenAIDevs
OpenAI 发布了 GPT-Realtime-2.1-mini 新模型,其 API 现已可用。该模型在 Realtime mini 系列中新增了推理能力和工具调用功能。定价与原有的 GPT-Realtime-mini 相同,开发者无需额外付费。
事件专题

推荐理由:OpenAI 新推 mini 实时模型,能推理还能调用工具,价格不变,适合实时场景开发。
07:49
07:49Hunyuan@TXhunyuan
精选
腾讯混元推出Hy3模型,总参数量295B,采用MoE架构。该模型在同类尺寸中性能最佳,可媲美万亿参数旗舰模型。支持Apache 2.0开源协议,并提供两周免费API体验(通过OpenRouter)。适用于大多数智能体场景。

推荐理由:腾讯混元新出的Hy3,295B参数量就能比肩万亿参数的大模型,还免费给你用两周,开源随便商用,搞智能体的别错过。
03:01
03:01AK@_akhaliq
精选
bottlecapai 基于 Qwen3.6-27B 微调推出 ThinkingCap-Qwen3.6-27B 模型,平均推理 token 减少 50%,最佳案例减少 90% 以上。该模型通过先进微调算法在多个领域和难度的问题集上训练。

推荐理由:bottlecapai 用 Qwen3.6-27B 微调的新模型能省一半推理 token,最快省九成,适合低成本推理场景。
01:11
01:11官方账号NVIDIA AI@NVIDIAAI
精选
在 ICML 2026 上,NVIDIA 的 Nemotron 模型和数据集被 145 篇论文引用。NVIDIA 自身有 74 篇论文被接受,约 2000 篇论文引用了 NVIDIA GPU。这些数据体现了 NVIDIA 在 AI 研究中的基础设施地位。Nemotron 作为开放模型正在成为现代 AI 研究的基础。
事件专题

推荐理由:NVIDIA在ICML 2026上刷了一波存在感:145篇论文用上Nemotron,74篇自家论文入选,还有2000篇靠NVIDIA GPU跑出来的。学术圈地位一览无余。
00:16
00:16OpenRouter@OpenRouterAI
DeepSeek V4在OpenRouter平台的周Token量达到6.6万亿(6.6T),超过小米的4.0T、Minimax的3.6T和腾讯的3.8T。同时,它超越了Anthropic的6.1T,成为平台上Token量最高的模型实验室。这表明DeepSeek V4在用户采用率和流量上取得显著优势。该数据于OpenRouter统计周期内更新。
事件专题

推荐理由:DeepSeek V4的周Token量干到了6.6T,超过Anthropic,也甩开其他国产模型。想直观对比模型热度?OpenRouter这组数据很说明问题。
7月6日
23:09
22:31
22:31The Rundown AI@therundownai
Meta展示了名为'Watermelon'的新模型,声称其性能与OpenAI的GPT-5.5相当。Cursor发布了移动版,用户可通过截图直接生成代码修复。联想推出售价44美元的学生AI手机。此外,还有4款新AI工具及社区工作流发布。
事件专题

推荐理由:Meta拿Watermelon对标GPT-5.5,Cursor手机版截图修bug,联想44刀学生AI手机,信息量很足!

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。