8月13日
18:10
18:10
18:10
18:10
18:10Fireworks AI@FireworksAI_HQ
精选
Qwen3.8-2.4T-A95B 已在 Fireworks 平台上线,提供 Day-0 支持。该模型采用 2.4T 参数 MoE 架构,专为自主智能体、重度编码和大上下文窗口设计。Fireworks 表示它适合编码和智能体任务,开发者现在即可开始使用。

推荐理由:Fireworks 上线了 Qwen3.8-2.4T-A95B,2.4T 参数 MoE,主打智能体和写代码,有 Day-0 支持,直接就能用。
18:09
18:09
18:09
18:07
18:06
18:06官方账号NVIDIA AI@NVIDIAAI
精选71°
Harvey联合Trajectory Labs对NVIDIA的Nemotron 3.5 Lightning进行后训练,在Legal Agent Bench上得分从0%升至8.3%。该成绩超过了Opus 4.6和更大的后训练版Nemotron 3 Ultra。后训练覆盖九个执业领域,未出现能力退化。平均输出长度从90k tokens降至37k tokens,每token奖励提升2.4倍。
事件专题

推荐理由:Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。
18:06
18:06IT之家博客/媒体
DeepSeek 发布 DeepSeek-V4-Pro-0813 正式版,API 同步上线更新。新版本增强了智能体能力,支持 Responses API 和 Codex 接入。在多项测试中,DeepSeek V4 Pro 正式版性能接近 Fable 5,相比预览版大幅提升。
事件专题

推荐理由:DeepSeek 又发新版本了,V4 Pro 正式版 API 已上线,智能体能力更强,还支持 Codex,性能直逼 Fable 5。
18:05
18:04
18:04官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA Nemotron 3.5 Lightning 已在 Together AI 平台上线。该模型被定位为同类中速度最快的开源模型。它专为常驻型智能体设计,能快速完成高吞吐量的专业工作。
事件专题

推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 开源模型上线 Together AI,跑得最快,适合需要高强度处理任务的智能体。
18:04
18:03
18:03官方账号Runway ML@runwayml
Runway 宣布 Grok Imagine Image 2.0 上线其平台。该模型是 Runway 当前提供的最新图像生成模型,与平台上其他图像和视频模型并列。用户现在即可通过 Runway 官方链接试用 Grok Imagine Image 2.0。
推荐理由:Grok Imagine Image 2.0 现在能在 Runway 直接用了,和顶级图像视频模型放一块,试图像生成又多了个选择。
18:02
18:02
18:02官方账号NVIDIA AI@NVIDIAAI
72°
NVIDIA今日推出Nemotron 3.5 Lightning模型,并已上线Tinker平台。该模型仅激活3B参数,针对吞吐速度进行优化。它面向对延迟和成本敏感的应用场景,适合高频实时推理任务。用户可在Tinker上直接体验该模型。
事件专题

推荐理由:NVIDIA出了个轻量级新模型,3B参数跑得快又便宜,延迟敏感场景用得上,Tinker上现在就能玩。
18:02
17:59
17:59
17:59AI Will@FinanceYF5
72°
xAI 发布 Grok 4.6,已上线 Cursor、Grok Build、API、OpenRouter、Vercel 和 Cloudflare 六个平台。普通版价格维持不变,Fast 版本价格翻倍。Cursor 与 Grok Build 首周提供 2 倍包含用量,现已开放试用。
事件专题

推荐理由:Grok 4.6 一口气上了 Cursor 和 API 等多个平台,普通版没涨价,Fast 版翻倍,首周还有双倍用量可薅。
17:56
17:55
17:55官方账号NVIDIA AI@NVIDIAAI
72°
英伟达宣布推出开源权重模型 Nemotron 3.5 Lightning。Deep Cogito 表示该模型继续推动开放模型生态,并宣布加入英伟达后训练合作伙伴生态。此次合作聚焦开源权重与可定制模型,旨在让前沿智能更易获取。
事件专题

推荐理由:英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。
17:55
17:55官方账号NVIDIA AI@NVIDIAAI
Uniphore实测NVIDIA Nemotron 3.5 Lightning在企业级智能体工作负载中的表现。与参数规模相近的Gemma 4 31B IT相比,Nemotron 3.5 Lightning吞吐量提升5倍,准确率也有明显增长。Uniphore已将其纳入Business AI Cloud高流量路径的评估范围。
事件专题

推荐理由:NVIDIA新模型在企业任务上直接碾压Gemma 4,吞吐量翻5倍,跑真实负载的数据很硬核。
17:55
17:54
17:54AI Will@FinanceYF5
75°
Grok 4.6正式发布,延续4.5的定价策略。新版本在Agent能力和编程任务上有所提升,并能更长时间处理复杂任务。在AA Intelligence Index基准上,Grok 4.6得分追平GPT-5.6 Sol。API价格为每百万输入Token 2美元,输出Token 6美元。
推荐理由:Grok 4.6发布,价格不变,Agent和编程更强,AA Intelligence Index追平GPT-5.6 Sol,API输入2美元/百万Token。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。