08:25AI Will@FinanceYF588°NVIDIA 近日发布 Nemotron 3 Ultra,这是一款专为长期运行的 AI Agent 设计的旗舰开源模型。该模型采用 550B 参数的 MoE 架构,激活参数仅 55B,推理速度比同级开源模型快 5 倍,Agent 任务成本降低 30%。Nemotron 3 Ultra 旨在解决复杂、长时间运行的 Agent 任务中的效率与成本问题,为开发者提供高性能且经济的选择。该模型的开源特性有望推动 Agent 应用生态的发展。AI模型NVIDIANemotron 3 Ultra开源模型10 个信源在谈事件专题推荐理由:做 Agent 开发的团队终于有了一个高性能且成本可控的开源选择——Nemotron 3 Ultra 推理快 5 倍、成本降 30%,值得直接上手试试。原文稍后读已读值得跟进有用关注 NVIDIA
03:09Jerry Liu@jerryjliu0精选LlamaIndex 创始人 Jerry Liu 指出,没有前沿实验室能独占成本、延迟与精度的帕累托前沿所有点,开源模型在成本上可低数个数量级。他观察到组织对模型路由和成本优化的兴趣激增,原因包括企业更谨慎管理成本,以及 AI 初创公司寻求构建护城河和提高毛利率。他引用 Chamath 的数据对比:每月 10 亿 token 输入/输出场景下,GPT-5.5 Pro 成本约 10.5 万美元,而 DeepSeek V4 Pro 仅需 5220 美元,能力差距远小于价格差距。Jerry 认为,随着控制平面(如 Software Factory)普及,前沿实验室收入增速将下降,开源模型收入将飙升。行业开源模型成本优化模型路由推荐理由:Jerry Liu 用真实成本数据揭示了模型选择的巨大经济差异,做 AI 应用选型或成本控制的团队值得仔细看——选对模型能省下 20-40 倍 token 成本。原文稍后读已读值得跟进有用关注 开源模型
13:20官方账号Perplexity@perplexity_ai72°Perplexity 宣布其 Pro 和 Max 订阅用户现在可以使用 Nemotron 3 Ultra 模型。该模型由 NVIDIA 开发,是一款专为长时间运行的智能体任务设计的新开源模型。此举将高性能的智能体能力直接提供给付费用户,无需额外配置。对于依赖 AI 进行复杂、持续任务的用户来说,这是一个直接可用的新选择。AI产品PerplexityNemotron 3 UltraNVIDIA10 个信源在谈事件专题推荐理由:做长任务智能体的开发者可以直接在 Perplexity 上体验 NVIDIA 的最新开源模型,省去部署成本,值得 Pro/Max 用户试试。原文稍后读已读值得跟进有用关注 Perplexity
08:27rohanpaul_ai@rohanpaul_aiAnthropic 表示其 80% 的新生产代码由 Claude 编写,标志着 AI 编程在大型科技公司中的深度应用。Google 新论文显示通用 LLM 通过规划证明和逐步检查,在形式数学任务上从低于 10% 提升至 70% 的准确率。Google 开源 Gemma 4 12B 模型,支持音频和视频分析,可在消费级 16GB GPU 上完全本地运行。阿里巴巴发布 Qwen3.7-Plus,支持文本、视频和图像输入,价格低廉但保持闭源。Anthropic 的化学报告也展示了令人惊讶的结果。行业AnthropicClaudeGoogle10 个信源在谈事件专题推荐理由:AI 编程和数学推理的突破正在改变开发和研究方式,做 AI 应用或数学研究的团队值得关注这些进展,尤其是 Claude 的代码生成和 Gemma 4 的本地部署能力。原文稍后读已读值得跟进有用关注 Anthropic
08:03Aravind Srinivas@AravSrinivasNVIDIA 最新的开源模型 Nemotron 3 Ultra 现已上线 Perplexity,面向所有 Pro 和 Max 用户开放。该模型专为长时间运行的智能体任务设计,是美国领先的开源模型之一。用户可以直接在 Perplexity 平台上体验其长上下文和推理能力。此举进一步丰富了 Perplexity 的模型选择,为开发者提供了更多开源选项。AI产品Nemotron 3 UltraNVIDIAPerplexity10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3 Ultra 是专为长时智能体任务设计的开源模型,做 AI 智能体开发的团队可以直接在 Perplexity 上试用,省去本地部署的麻烦。原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
05:16lmarena.ai@lmarena_aiImage Arena 最新排名显示,开源文生图模型竞争激烈。Ideogram-4.0 Quality 以 1204 分位居第一,腾讯 Hunyuan Image 3.0 以 1151 分紧随其后,仅比第三名 Flux-2 Dev 高 1 分。阿里 Qwen Image 2512 和 HiDream-O1 Image 分别位列第四和第五。前六名来自不同实验室,而 Flux 和 Qwen 在前 15 名中占据多个席位,显示出深度优势。AI模型文生图开源模型Ideogram推荐理由:开源文生图模型的排名变化直接反映技术趋势,做图像生成应用或研究的人可以据此选择模型,值得关注 Ideogram 和 Hunyuan 的最新进展。原文稍后读已读值得跟进有用关注 文生图
22:18Paul Couvert@itsPaulAi72°NVIDIA 发布了开源模型 Nemotron 3 Ultra,专为智能体任务和编程设计。该模型在性能上接近闭源模型 GPT 5.5,但推理成本仅为后者的十分之一($0.051 vs $0.57)。Nemotron 3 Ultra 速度比同类模型快5倍,成本低30%,已在 Hugging Face 上开源。这标志着开源模型与闭源模型之间的质量差距正在迅速缩小,尤其适合处理大型代码库和智能体应用。AI模型NVIDIANemotron 3 Ultra开源模型10 个信源在谈事件专题推荐理由:开源模型性能逼近闭源,成本却低一个数量级——做智能体或编程的开发者可以直接在 Hugging Face 上试用,省下不少推理预算。原文稍后读已读值得跟进有用关注 NVIDIA
19:26官方账号SiliconFlowAI@siliconflowaiDeepSeek 在 OpenRouter 平台上的 Token 使用量连续四周排名第一,显示出其模型在开发者社区中的广泛采用。SiliconFlow 宣布为这一份额提供重要支持,并提供了完整的 DeepSeek 模型系列,包括 V4 Pro、Flash、V3.2 等,其中 V4 Pro 和 Flash 以最佳性价比著称。这一趋势反映了 DeepSeek 在开源模型领域的竞争力,尤其是在推理和编程任务上的表现。AI模型DeepSeekOpenRouterToken 份额推荐理由:DeepSeek 连续四周霸榜 OpenRouter Token 份额,说明开发者正在大量使用其模型做推理和编程。如果你在找性价比高的开源模型,SiliconFlow 上 V4 Pro 和 Flash 值得试试。原文稍后读已读值得跟进有用关注 DeepSeek
11:02阮一峰的网络日志(博客/媒体)精选今年5月,一个美国科技分析师访问团走访了DeepSeek、月之暗面、字节跳动等14家中国AI和机器人公司,回国后撰写了多篇观感文章。访问团发现,中国AI行业面临严重的算力不足,2025年底美国算力约为中国的8倍,但中国公司通过极高的计算效率弥补了这一差距,单位算力支持的AI智能是简单扩展下的4-7倍。中国公司内部对开源模型存在分歧,万亿参数模型的开源与否成为分水岭。此外,中国AI公司大量使用年轻实习生,他们享有全职待遇和完整权限,与西方公司形成鲜明对比。访问团还观察到,中国研究人员对AGI的态度坦然,不恐惧被取代,而中国企业AI需求正从SaaS模式转向云计算市场。行业AI大厂算力差距开源模型推荐理由:这篇访问记揭示了中美AI竞争的真实图景——算力落后但效率反超,做AI模型或投资的从业者能从中看到中国公司的独特策略和生存智慧,值得细读。原文稍后读已读值得跟进有用关注 AI大厂
08:12lmarena.ai@lmarena_ai精选83°NVIDIA 今日正式发布 Nemotron 3 Ultra,这是一款 550B 参数的混合专家(MoE)开源模型,定位为前沿智能(frontier-intelligence)模型,专为长时间运行的智能体任务打造。相比其他开源前沿模型,Nemotron 3 Ultra 推理速度提升 5 倍,复杂智能体任务成本降低高达 30%。该模型旨在解决当前开源模型在长周期、高复杂度任务中推理慢、成本高的问题,为开发者提供更高效的智能体基础设施。AI模型NVIDIANemotron 3 UltraMoE10 个信源在谈事件专题推荐理由:做智能体开发和部署的团队终于有了一个开源的高效选择——Nemotron 3 Ultra 直接降低长任务推理成本 30%,建议关注并测试其在实际 agent 场景中的表现。原文稍后读已读值得跟进有用关注 NVIDIA
01:18Paul Couvert@itsPaulAiNvidia 发布了 Nemotron 3 Ultra 开源 AI 模型,专为智能体任务和编程场景优化。该模型在推理速度上比同类模型快 5 倍,成本降低 30%,并已在 Hugging Face 上开放下载。它特别适合处理大型代码库,并支持 Hermes Agent 等智能体框架。这一发布意味着开发者可以更高效、更经济地构建 AI 智能体应用。AI模型NvidiaNemotron 3 Ultra开源模型10 个信源在谈事件专题推荐理由:做智能体开发或大型代码库编程的团队,终于有了一个又快又便宜的开源选择——Nemotron 3 Ultra 速度提升 5 倍、成本降低 30%,值得直接上 Hugging Face 试试。原文稍后读已读值得跟进有用关注 Nvidia
00:12Geek@geekbb精选Nvidia 与 Nous Research 合作,在 Hermes 平台(Nous Portal)上提供最新的 Nemotron 3 Ultra 模型免费使用两周。该模型属于开放前沿基础模型,旨在推动开源模型发展。用户可通过 Nous Portal 直接访问并体验。AI模型Nemotron 3 UltraNvidiaNous Research10 个信源在谈事件专题推荐理由:免费体验强模型原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
23:40Paul Couvert@itsPaulAi精选NVIDIA发布了新的开源模型,其基准测试成绩与两倍大小的模型相当。该模型推理速度更快且成本更低。NVIDIA同时公开了模型权重、训练数据和配方。这标志着开源模型在效率上取得了进步。AI模型NVIDIA开源模型基准测试10 个信源在谈事件专题推荐理由:NVIDIA开源模型性价比高原文稍后读已读值得跟进有用关注 NVIDIA
22:39elvis@omarsar083°NVIDIA 发布了 Nemotron 3 Ultra,一个 550B 参数的混合专家(MoE)开源模型,专为长时间运行的智能体任务优化。该模型在推理速度上比同类开源前沿模型快 5 倍,同时将复杂智能体任务的成本降低高达 30%。这标志着开源模型在支持本地长时间运行编程智能体方面迈出了重要一步,为开发者提供了更高效、更经济的替代方案。AI模型NVIDIANemotron 3 UltraMoE10 个信源在谈事件专题推荐理由:做智能体或编程助手的开发者终于有了一个开源的高效选择——Nemotron 3 Ultra 在速度和成本上显著优于同类模型,值得立即关注和测试。原文稍后读已读值得跟进有用关注 NVIDIA
21:27官方账号NVIDIA AI@NVIDIAAI93°NVIDIA 今日正式推出 Nemotron 3 Ultra,一款 550B 参数的 MoE(混合专家)开源模型,专为长时间运行的智能体任务设计。相比其他开源前沿模型,该模型推理速度提升 5 倍,复杂智能体任务成本降低高达 30%。Nemotron 3 Ultra 旨在解决长周期 AI 任务中的效率与成本瓶颈,为开发者提供更经济、更快速的智能体部署方案。NVIDIA 强调其“前沿智能”级别性能,并保持开源,进一步推动 AI 生态发展。AI模型NVIDIANemotron 3 UltraMoE10 个信源在谈事件专题推荐理由:做智能体开发和部署的团队终于有了一个兼顾性能与成本的开源选择——Nemotron 3 Ultra 的 5 倍推理加速和 30% 成本降低值得直接上手测试。原文稍后读已读值得跟进有用关注 NVIDIA
16:15官方一手marktechpost@Asif Razzaq精选Miso Labs 发布了 MisoTTS,一个 8B 参数的开源文本转语音模型,专注于情感表达。它采用残差向量量化(RVQ)技术,在不增加参数的情况下扩展声音范围,并能根据文本和音频上下文调整说话人语调。模型架构由 7.7B 主骨干和 300M 深度解码器组成。MisoTTS 的开放权重让开发者和研究者可以自由使用和定制,推动了情感语音合成领域的开源进展。AI模型文本转语音情感合成开源模型推荐理由:MisoTTS 解决了 TTS 模型情感表达不足的痛点,做语音合成、虚拟助手或内容创作的团队可以直接下载权重试用,感受 8B 模型带来的细腻语调变化。原文稍后读已读值得跟进有用关注 文本转语音
12:18小互@imxiaohu78°Google 发布了 Gemma 4 12B 开源模型,采用无编码器架构,能直接处理文字、图像、音频和视频四种输入,无需传统视觉或音频编码器。该模型可在 16GB 显存的笔记本上运行,4-bit 量化后仅需 8GB 显存。支持 256K Token 上下文窗口、140 多种语言,并内置逐步推理和原生函数调用功能。这一架构创新降低了多模态 AI 的硬件门槛,让普通用户也能在本地运行全模态模型。AI模型Gemma 4开源模型多模态10 个信源在谈事件专题推荐理由:无编码器架构让多模态模型不再依赖专用编码器,16GB 笔记本就能跑全模态 AI,做本地 AI 应用或边缘计算的开发者可以直接试试。原文稍后读已读值得跟进有用关注 Gemma 4
10:00官方账号Jeff Dean@JeffDean精选谷歌发布Gemma 4 12B模型,采用Apache 2.0许可证开放权重。该模型采用无编码器多模态架构,统一处理文本、图像等输入。12B参数规模可在笔记本电脑上直接运行,兼顾边缘效率与高级推理。AI模型Gemma 4 12BGoogleApache 2.02 个信源在谈事件专题推荐理由:12B模型笔记本就能跑原文稍后读已读值得跟进有用关注 Gemma 4 12B
08:22berryxia@berryxiaGoogle 昨晚发布了 Gemma 4 12B 多模态大模型,该模型支持文本和图像输入,最低只需 16GB 内存即可运行。这降低了多模态模型的本地部署门槛,适合个人开发者和资源受限的环境。与 Qwen 等同类模型的对比结果值得关注,可能影响开源多模态模型的竞争格局。AI模型多模态模型Gemma 4Google10 个信源在谈事件专题推荐理由:多模态模型本地运行门槛进一步降低,做 AI 应用或本地部署的开发者可以关注 Gemma 4 与 Qwen 的对比,评估是否值得迁移或尝试。原文稍后读已读值得跟进有用关注 多模态模型
06:44官方账号Clement Delangue@ClementDelangueHugging Face CEO Clement Delangue 在 X 上发帖调侃,认为现在即使把开源模型命名为“0pus 4.8”或“GPT 5.S”放进应用,用户也会大量使用而不抱怨。他指出这是“前沿”营销的力量——品牌和命名比实际技术更能吸引用户。这条推文引发了关于 AI 行业品牌效应与真实技术差距的讨论。行业开源模型品牌营销前沿模型推荐理由:做 AI 应用或营销的团队值得看看——品牌命名对用户认知的影响可能远超技术本身,别让“前沿”标签蒙蔽了你的判断。原文稍后读已读值得跟进有用关注 开源模型
03:00官方账号Decoder@Matthias Bastian78°Ideogram 发布了其文本到图像模型 4.0 版本,作为开源权重模型,支持原生 2K 分辨率、边界框控制和改进的文本渲染。在 DesignArena 排行榜上,它在所有开源模型中排名第一,仅落后于 OpenAI 和 Google 的闭源系统。商业使用需要付费许可。AI模型Ideogram文本到图像开源模型10 个信源在谈事件专题推荐理由:对于需要高质量图像生成且注重文本准确性的创作者和开发者,Ideogram 4.0 的开源权重版本提供了顶级性能,值得尝试。原文稍后读已读值得跟进有用关注 Ideogram
02:35官方账号Demis Hassabis@demishassabis精选Google 发布 Gemma 4 12B 模型,庆祝其总下载量突破 1.5 亿次。该模型体积小巧,仅需 16GB VRAM 即可在笔记本上本地运行。采用 Apache 2.0 开源许可证,开发者可自由使用和修改。AI模型GemmaGemma 4Google10 个信源在谈事件专题推荐理由:小模型也能本地跑,性能强原文稍后读已读值得跟进有用关注 Gemma
02:01官方账号阶跃星辰 Stepfun@Stepfun_AIStepFun 与 Modal 合作,发布了在 Modal 无服务器 AI 平台上部署 Step 3.7 Flash 模型的指南。该方案使用 8×H100 GPU、Modal Volumes 和 SGLang,提供 OpenAI 兼容的聊天补全端点。开发者无需管理基础设施即可快速部署和扩展推理工作负载。这降低了 StepFun 开源模型的使用门槛,让更多构建者能轻松调用。AI产品Step 3.7 FlashModalSGLang10 个信源在谈事件专题推荐理由:想低成本部署开源推理模型的团队,现在可以直接在 Modal 上跑 Step 3.7 Flash,免去 GPU 管理烦恼,还自带 OpenAI 兼容接口,建议试试。原文稍后读已读值得跟进有用关注 Step 3.7 Flash
01:28官方账号SiliconFlowAI@siliconflowai83°MiniMax 最新开源模型 M3 已在 SiliconFlow 平台上线,首周提供 50% 折扣。M3 是首个同时具备编码与智能体能力、1M 上下文窗口和原生多模态的开源模型。在 SWE-Bench Pro 基准测试中,M3 的编码能力超越了 GPT-5.5 和 Gemini 3.1 Pro。其 1M 上下文窗口通过 MiniMax 稀疏注意力技术实现,原生多模态支持图像、视频和计算机使用。定价方面,缓存/输入/输出分别为每百万 token 0.06/0.30/1.20 美元,折扣后性价比突出。AI模型MiniMaxM3开源模型推荐理由:M3 把编码、长上下文和多模态三合一开源了,做 AI 应用开发的团队可以直接在 SiliconFlow 上低成本试用,编码能力还超过了 GPT-5.5,值得上手体验。原文稍后读已读值得跟进有用关注 MiniMax
00:32lmarena.ai@lmarena_ai76°Ideogram-4.0-Quality 在文生图领域成为新的开源模型第一名,在所有子类别上相比前代有巨大提升。尤其在文本渲染和产品、品牌与商业设计方面进步最为显著。该模型在公开评测中表现优异,标志着开源文生图模型质量迈上新台阶。AI模型Ideogram-4.0-Quality文生图开源模型推荐理由:做设计或品牌营销的团队终于有了一个能打的开源文生图模型——Ideogram-4.0-Quality 在文本渲染和商业设计上进步明显,值得直接上手试试。原文稍后读已读值得跟进有用关注 Ideogram-4.0-Quality
00:23Replicate@replicate精选Ideogram 4.0 图像模型正式发布,原生支持 2K 分辨率,并显著提升了排版能力。该模型完全开源,用户可下载权重进行微调,并在本地硬件上运行。模型已上线所有 Ideogram 计划和 API。此前版本在文本渲染方面较弱,4.0 版本在这一领域取得了突破。AI模型IdeogramIdeogram 4.0开源模型4 个信源在谈事件专题推荐理由:Ideogram 4.0 开源,2K原生,排版强原文稍后读已读值得跟进有用关注 Ideogram
23:58Ideogram@ideogram_ai精选Ideogram 4.0 正式发布,声称是当前最好的开源图像模型。模型权重可下载,支持用户在自己的数据上微调并在本地硬件运行。该模型已上线所有 Ideogram 订阅计划和 API。AI模型Ideogram开源模型图像生成推荐理由:Ideogram 4.0 开源了,能自己微调原文稍后读已读值得跟进有用关注 Ideogram
08:52官方账号Clement Delangue@ClementDelangue精选Hugging Face CEO Clement Delangue 指出,UI 中自动的幕后模型路由(而非模型选择器)将把价值捕获和使用重新分配给更多模型,尤其是开源/小型/廉价模型。这消除了用户手动切换模型的认知负担,避免用户默认使用前沿模型。Factory 推出的 Router 功能可自动为每个任务选择最佳模型,在保持前沿性能的同时将成本降低 25%。这一趋势将改变 AI 应用的价值分配格局。AI产品模型路由Factory成本优化推荐理由:模型路由解决了用户手动选模型的痛点,做 AI 应用或 API 调用的团队可以直接用 Factory Router 降本增效,值得关注。原文稍后读已读值得跟进有用关注 模型路由
22:37官方账号Nathan Lambert: Interconnects@Nathan Lambert作者在艾伦人工智能研究所(Ai2)的最后一周,回顾了参与 Olmo 模型开发的工作经历。文章分享了在 Ai2 的成长与学习,以及如何通过 Olmo 模型产生广泛而持久的影响。这不仅是个人告别,也反映了开源 AI 研究机构的发展与挑战。行业Ai2Olmo开源模型推荐理由:对于关注开源大模型和 AI 研究机构动态的从业者,这篇文章提供了 Olmo 模型背后的真实视角和行业思考,值得一读。原文稍后读已读值得跟进有用关注 Ai2
10:35Harrison Chase@hwchase17精选76°MiniMax 正式发布 M3 模型,这是首个同时具备编码、智能体能力和原生多模态的开放权重模型。在 SWE-Bench Pro 上达到 59.0%,Terminal Bench 2.1 为 66.0%,并支持 1M 上下文窗口。模型权重和技术报告将在约 10 天后公开。开发者可通过 API 和专属代码平台 code.minimax.io 使用。AI模型MiniMaxM3开源模型推荐理由:MiniMax M3 把编码、智能体和多模态三合一开源,做 AI 应用和 Agent 开发的团队可以直接拿来用,尤其适合需要长上下文和复杂任务自动化的场景。原文稍后读已读值得跟进有用关注 MiniMax
10:14Justine Moore@venturetwins该推文汇总了 a16z 投资的多家 AI 初创公司,涵盖开源生成式模型、AI 照片工具、3D 世界模型、AI 角色实验室和矢量图形基础模型。这些项目代表了生成式 AI 在图像、视频、3D 和图形设计等领域的多元化应用。对于关注 AI 创业生态和开源模型的开发者、设计师和投资者来说,这是一份值得关注的公司清单。行业a16z开源模型生成式 AI推荐理由:a16z 的 AI 投资版图揭示了生成式 AI 的下一个热点方向,做 AI 应用或模型开发的团队可以从中发现潜在合作或学习对象。原文稍后读已读值得跟进有用关注 a16z
08:23Guillermo Rauch@rauchg76°MiniMax M3 在 Next.js 智能体评测中成为领先的开源模型,性能仅次于 Opus 和 GPT-5,但成本低 10 倍。这是 MiniMax 首个支持多模态输入的长上下文模型。Vercel 宣布 M3 已上线 AI Gateway,并提供一周 50% 折扣。开发者可以以极低成本获得接近顶级模型的智能体能力。AI模型MiniMax M3开源模型智能体6 个信源在谈事件专题推荐理由:做 Next.js 智能体开发的团队终于有了高性价比的开源选择——M3 性能接近 Opus 但成本仅 1/10,Vercel 用户现在就能用上,建议立刻试试。原文稍后读已读值得跟进有用关注 MiniMax M3
02:53官方账号Clement Delangue@ClementDelangueHugging Face CEO Clement Delangue 发推称赞 NVIDIA 是“美国开源 AI 之王”,指出 NVIDIA 在 Hugging Face 上已拥有超过 1000 个公开仓库(820 个模型、249 个数据集、57 个空间),粉丝近 6 万。当前 HF 上排名第一的热门模型是 LocateAnything,排名第五的是 PiD。NVIDIA 宣布采用 Linux 基金会的 OpenMDW 框架,并发布了 Cosmos 3(用于物理 AI 的全模态世界模型)、Alphamayo 2 Super(自动驾驶开源模型),以及即将推出 Nemotron 3 和正在开发中的 Nemotron 4。这些成果展示了 NVIDIA 在开源 AI 生态中的持续投入和领导力。行业NVIDIA开源模型Hugging Face10 个信源在谈事件专题推荐理由:NVIDIA 在开源 AI 上的投入远超多数人想象——1000 个公开仓库、多个前沿模型,做 AI 研究或开发的团队值得关注这些新资源,尤其是 Cosmos 3 和 Nemotron 系列。原文稍后读已读值得跟进有用关注 NVIDIA
21:50官方账号Decoder@Jonathan Kemper78°中国AI公司MiniMax发布了新模型M3,号称是首个结合顶级编码性能、百万token上下文窗口和原生多模态能力的开源权重模型。该模型在多项基准测试中表现优异,尤其在长上下文任务和代码生成方面,直接挑战GPT-4、Claude等闭源模型。M3的开源特性使得开发者可以自由部署和微调,降低了使用门槛。这一发布标志着开源模型在关键能力上正快速追赶闭源方案。AI模型MiniMaxM3开源模型推荐理由:百万token上下文+开源权重,做长文档处理或代码分析的团队可以直接部署,不用再被闭源API的token计费卡脖子。原文稍后读已读值得跟进有用关注 MiniMax
21:50官方账号Decoder@Maximilian Schreiner基准测试平台 Artificial Analysis 显示,Nvidia 的 Nemotron 3 Ultra 是目前美国最强大的开源 AI 模型,在多项指标上超越此前领先的 Llama 3 等模型。然而,该模型在整体性能上仍落后于中国开源模型如 DeepSeek 和 Qwen,表明中国在开源 AI 领域的领先地位依然稳固。这一进展凸显了美国在开源模型竞争中的追赶态势,但中国模型在推理、多模态等关键能力上仍保持优势。AI模型NvidiaNemotron 3 Ultra开源模型10 个信源在谈事件专题推荐理由:Nvidia 终于拿出了美国最强的开源模型,但中国开源模型依然领先,做模型选型和对比的开发者值得关注这一格局变化。原文稍后读已读值得跟进有用关注 Nvidia
13:05IT之家(博客/媒体)精选76°英伟达发布 Alpamayo 2 Super,一款 320 亿参数的视觉-语言-动作(VLA)开源模型,专为 L4 自动驾驶研发设计。该模型具备类人感知、推理与行动能力,支持全车环视感知和元动作输出,可免去企业从零搭建核心基础设施。英伟达同步推出 AlpaGym 闭环强化学习平台、OmniDreams 世界模型等工具,打通从数据采集到车载部署的全流程。模型定位为教师模型,可通过知识蒸馏部署在 DRIVE AGX Thor 芯片上,已获比亚迪、吉利等车企采用。推理代码预计夏季开源。AI模型英伟达Alpamayo 2 Super自动驾驶推荐理由:英伟达把自动驾驶模型参数翻了三倍,还开源了全套工具链,做 L4 研发的团队可以直接省掉从零搭建的环节,建议关注夏季开源代码。原文稍后读已读值得跟进有用关注 英伟达
12:50IT之家(博客/媒体)精选78°英伟达发布 Nemotron 3 Ultra 开源模型,拥有 5500 亿参数,采用混合专家架构,专为全天候运行的自主智能体设计。该模型在推理速度上较同级别前沿模型最高提升 5 倍,使用成本降低 30%,并已适配 Hermes Agent、LangChain 等主流智能体平台。同时推出安全防护和语音识别模型,增强企业级智能体能力。CrowdStrike 和 Palantir 已将其用于网络安全和业务流程自动化。模型将于 6 月 4 日通过 Hugging Face 等平台以 NIM 微服务形式开放。AI模型英伟达Nemotron 3 Ultra开源模型5 个信源在谈事件专题推荐理由:英伟达把大模型推理速度和成本同时优化了,做智能体开发或企业自动化的团队可以直接用上,比现有开源方案更高效省钱,值得关注。原文稍后读已读值得跟进有用关注 英伟达
12:35官方账号NVIDIA AI@NVIDIAAI精选NVIDIA AI 官方推特宣布,新一代大语言模型 Nemotron 3 Ultra 将于本周内推出。这是 Nemotron 系列的最新版本,具体参数和性能细节尚未披露。此前 Nemotron 4 340B 以推理基准上的表现受到关注,业界期待新版本能否进一步在效率和准确性上提升。AI模型Nemotron 3 UltraNVIDIA开源模型7 个信源在谈事件专题推荐理由:NVIDIA 终于要发新模型了原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
11:12OpenRouter@OpenRouterAI精选76°MiniMax 发布了 M3 模型,这是首个同时具备编码、智能体与多模态能力的开源权重模型。在 SWE-Bench Pro 上达到 59.0%,Terminal Bench 2.1 上 66.0%,并支持 1M 上下文窗口。模型原生多模态,从零开始训练,权重和技术报告将在约 10 天后公开。API 已上线 platform.minimax.io,并提供 MiniMax Code 工具。AI模型MiniMaxM3开源模型推荐理由:MiniMax M3 把编码、智能体和多模态三个前沿能力打包进一个开源模型,做 AI 应用开发或智能体研究的团队可以直接用 API 体验,值得关注即将开源的权重。原文稍后读已读值得跟进有用关注 MiniMax
11:11OpenRouter@OpenRouterAI精选76°MiniMax-M3 是一款前沿开源权重模型,已在 OpenRouter 平台上线。它集成了 100 万 token 的超长上下文窗口、顶尖的编程与智能体能力,以及原生支持图像和视频的多模态处理。该模型在编码和智能体任务上表现卓越,同时保持了开源特性,为开发者和研究者提供了强大的工具。其 1M token 上下文窗口尤其适合处理长文档、复杂代码库和多模态数据融合场景。AI模型MiniMax-M3开源模型长上下文6 个信源在谈事件专题推荐理由:MiniMax-M3 把长上下文、强编码和多模态塞进一个开源模型里,做复杂智能体或长文档处理的团队可以直接在 OpenRouter 上试,省去自己部署的麻烦。原文稍后读已读值得跟进有用关注 MiniMax-M3