7月21日
16:10
16:10AI Will@FinanceYF5
Kimi-K3在Arena AI前端代码竞技场获得1679分,超过Claude Fable 5的1631分。这是中国模型首次在该竞技场超越美国模型。上一次中国模型逼近该位置是2025年初的DeepSeek-R1。该结果由中国AI公司月之暗面推出。
事件专题

推荐理由:Kimi-K3在代码竞技场拿了1679分,比Claude Fable 5高48分,中国模型第一次赢美国模型,可以看看。
15:19
13:57
10:10
05:32
05:32OpenRouter@OpenRouterAI
OpenRouter 发布 Krea 2 Medium,定位为快速、低成本的通用图像生成起点。该模型在插画、动漫、绘画和表现主义风格上生成稳定一致。相比 Krea 2 完整版,Medium 版推理速度提升约 40%,API 定价降低 60%,适合批量创作和实验。
推荐理由:OpenRouter 出了个 Krea 2 Medium,速度快一半、价格打六折,画插画和动漫风格很稳,适合日常批量出图。
04:23
04:21
04:21官方账号NVIDIA AI@NVIDIAAI
Poolside的Laguna模型现已可在NVIDIA DGX Spark上本地运行。DGX Spark是NVIDIA推出的桌面级AI超级计算机。这使得Laguna模型能够在个人设备上进行高效推理,无需依赖云服务。具体性能指标尚未公布。
事件专题

推荐理由:Poolside把Laguna模型放进了NVIDIA的DGX Spark小盒子,以后本地跑代码生成模型更方便了。
01:52
01:52官方账号Cursor@cursor_ai
一个AI智能体团队基于SQLite的835页官方手册,成功重建出Rust语言副本。该副本在保留测试套件中通过率达到100%。成本因使用的模型组合不同而波动,最高差距达15倍。实验展示了多智能体协作在复杂代码重构中的潜力。
事件专题

推荐理由:看看AI智能体怎么读835页手册,把SQLite用Rust重写了一遍,还100%过测试,成本差15倍挺有意思。
01:31
01:18
01:18官方账号Microsoft Research@MSFTResearch
微软研究院发布多项AI成果:Aurora 1.5实现了开放预测,Flint改进了可视化技术,FlowDAgger加速了模型适应。此外,AI智能体成功破解了Rowhammer硬件安全防御,新型内存架构重塑了对话式AI。
推荐理由:微软一口气发了Aurora 1.5、Flint和FlowDAgger,从预测、可视化到模型适应都有新进展,还攻破了Rowhammer安全防御,干货很多。
00:28
00:28官方账号NVIDIA AI@NVIDIAAI
NVIDIA 宣布完全开源 Cosmos 3 Edge 模型,包含完整的模型权重、后训练配方和代码。该模型已在 Hugging Face 平台上线,用户可自由下载使用。这是 NVIDIA 边缘 AI 系列的最新开源版本。
事件专题

推荐理由:NVIDIA 把 Cosmos 3 Edge 完全开源了,模型权重和训练代码都在 Hugging Face 上,直接就能拿下来玩。
00:27
00:27官方账号NVIDIA AI@NVIDIAAI
77°
NVIDIA 推出 Cosmos 3 Edge,一个拥有 4B 参数的开源世界模型。该模型包含一个基于 Nemotron 的 2B 参数量推理器,可在 DGX Spark、NVIDIA Jetson 等设备上本地运行。它主要服务于机器人学习、自动驾驶场景理解和智能基础设施的视觉 AI 推理。
事件专题

推荐理由:NVIDIA 开源了一个能在边缘设备上跑的世界模型 Cosmos 3 Edge,4B 参数加 2B 推理器,机器人、自动驾驶都能用,Jetson 上就能跑。
00:15
7月20日
21:40
21:40岚叔@lufzzliz
Qwen-3.8 Max 参数量2.4T,支持多模态和1M上下文。同任务下速度比Kimi-K3快十倍,对探索性任务性价比高。前端能力与SOTA模型不相上下,限时一折、夜间0.2折。正式版将开源并持续进化,擅长Cowork类Agent任务。
事件专题

推荐理由:阿里发了Qwen-3.8 Max预览版,参数量2.4T,速度比Kimi-K3快一个数量级,限时一折,正式版很快开源,感兴趣可以试试。
21:12
21:12官方账号阿里通义 Qwen@Alibaba_Qwen
阿里巴巴Qwen团队发布Qwen3.8-Max-Preview的最新版本,在多项能力上取得广泛进步,尤其在Web前端任务上有显著提升。该模型仍处于每日迭代中,团队邀请用户测试并反馈问题。未来计划发布更强大的正式版,并开源模型权重。
推荐理由:Qwen3.8预览版每天都在进化,这次Web前端进步特别大,写网页生成代码的好工具,快去试试吧。
13:09
13:09AI Will@FinanceYF5
该开源模型支持单摄像头视频输入,无需LiDAR,即可实时重建3D场景。在1万多帧长视频下仍保持稳定,单卡可达20fps。在无人机航拍、行车记录、室内漫游等场景测试中,性能优于传统优化类方法。
推荐理由:国内团队开源了一个超牛的模型,拿手机拍段视频就能实时生成3D场景,单卡跑20帧,上万帧不崩,比传统方法强,推荐给搞3D重建的朋友。
07:18
02:54
02:54elvis@omarsar0
精选73°
Qwen 3.8 即将发布并开源权重,该模型拥有2.4T参数,据称仅次于 Fable 5。其前代 Qwen 3.7 在 Hermes Agent 等子代理工作流中表现出色。目前 Qwen3.8-Max-Preview 已在阿里云 Token Plan、Qoder 和 QoderWork 平台开放试用。
推荐理由:如果你在用智能体工作流,Qwen 3.7 已经很好用,3.8 参数翻倍到 2.4T,开源且性能接近 Fable 5,值得试试预览版。
01:48
01:48The Rundown AI@therundownai
77°
阿里巴巴 Qwen 宣布即将开源模型 Qwen3.8,参数量达 2.4T。官方称该模型是目前最强模型之一,性能仅次于是 Fable 5。预览版 Qwen3.8-Max-Preview 已上线阿里云的 Token Plan、Qoder 和 QoderWork 平台。开发者可抢先体验,项目开源在即。
事件专题

推荐理由:阿里要开源 2.4T 参数的 Qwen3.8,称仅次于 Fable 5,预览版已能玩,模型迷可以蹲一波。
7月19日
21:37
21:27
21:27shao__meng@shao__meng
DeepSeek V4 和 GLM 5.2 已发布。本周 Kimi K3 和 Qwen 3.8 曝光,对标 Claude Fable 5 和 GPT-5.6 Sol。Tencent Hy3 提升很大,MiniMax M3 落后但后续期待。Gemini 3.5 Pro 原定7月17日发布,因内部评估未通过而推迟。
事件专题

推荐理由:这周模型圈太热闹了,DeepSeek V4、GLM 5.2 刚发,Kimi K3 和 Qwen 3.8 又来了,还有 Claude 和 GPT 对标,开源 SOTA 随时变天。
18:59
18:59岚叔@lufzzliz
阿里发布Qwen3.8-Max-Preview模型,参数规模超过2万亿。官方评测称其性能仅次于Fable 5。该模型已在Token Plan、Qoder和QoderWork平台上线。作为新一代大参数模型,它旨在提升推理和多任务能力。
推荐理由:阿里新出的2万亿参数大模型Qwen3.8-Max-Preview,号称只比Fable 5差一点,已经能直接试用了,想看看它有多强可以测测。
18:18
18:08
18:08官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云宣布 Qwen3.8 即将发布并开源权重,模型参数规模达 2.4T。官方称其兼容领先前沿 AI 模型,综合能力仅次于 Fable 5。预览版 Qwen3.8-Max-Preview 已上线 Token Plan、Qoder 和 QoderWork 平台。用户可率先体验这一开源大模型。

推荐理由:阿里云发了 Qwen3.8,2.4T 参数即将开源,预览版现在就能在 Token Plan 上试,看看是不是真仅次于 Fable 5。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。