23:23lmarena.ai@lmarena_ai精选78°NVIDIA应用深度学习研究副总裁Bryan Catanzaro与Peter Gostev讨论了Nemotron模型家族的构建过程,以及NVIDIA加速开放模型发布的原因。讨论内容包括特殊教师模型在构建强大能力中的作用,训练后推理的挑战,开源模型的重要性,以及这一切对NVIDIA构建Nemotron的意义。行业NVIDIANemotron模型家族开放模型4 个信源在谈事件专题推荐理由:想了解NVIDIA如何快速发布前沿开放模型?来看看Bryan Catanzaro和Peter Gostev的讨论,了解Nemotron模型家族的构建过程和开源模型的重要性。原文稍后读已读值得跟进有用关注 NVIDIA
03:33elvis@omarsar072°开放模型代币份额从28%增长至62%,多代理系统模式在多个领域被广泛采用,子代理在代币使用中占主导地位。开源AI在降低模型层利润的同时,对AI基础设施需求产生积极影响。开放源代码代币的生产成本与前沿代币相当,预计最终封闭、前沿代币将占经济价值的60-90%,但仅占代币的15-25%。AI模型开放模型代币份额多代理系统推荐理由:开源AI的代币份额增长表明其在AI基础设施需求中的重要性,值得关注其发展动态。原文稍后读已读值得跟进有用关注 开放模型
12:03ollama@ollama72°PoolsideAI与NVIDIA工程师合作推出开放模型,旨在构建美国开放人工智能生态系统,与中美AI巨头竞争。行业PoolsideAINVIDIA开放模型7 个信源在谈事件专题推荐理由:PoolsideAI和NVIDIA合作推出开放模型,值得关注其未来发展。原文稍后读已读值得跟进有用关注 PoolsideAI
07:58官方账号Clement Delangue@ClementDelangue71°Vercel AI Gateway显示开放模型权重占比已达62%,较两个月前增长显著。企业采用仍处于早期阶段,工具需适配模型无关性。行业开放模型AI工作负载Vercel推荐理由:Vercel最新数据显示,开放模型在AI工作负载中的占比显著提升,值得关注。原文稍后读已读值得跟进有用关注 开放模型
22:13Gary Marcus@GaryMarcus72°Anthropic的ARR可能存在双重含义,引发行业关注。其收入可能不会持续,随着转向开放模型而减少。行业AnthropicARR收入模式8 个信源在谈事件专题推荐理由:Anthropic的ARR定义引发行业讨论,了解其收入模式变化。原文稍后读已读值得跟进有用关注 Anthropic
11:37AI Will@FinanceYF5Brex统计显示2026年夏季增长最快的25家软件公司中,14家销售AI基础设施产品。Together AI以开放模型服务位居榜首,另有6家基于这些基础设施开发AI产品。AI热潮中,算力、数据库、缓存和沙箱等基础设施增速最快。行业Together AIBrexAI基础设施推荐理由:Brex报告揭示AI赚钱热点已从应用转向基础设施,Together AI领跑这波趋势。原文稍后读已读值得跟进有用关注 Together AI
01:29官方账号Hugging Face@huggingfaceHuggingFace发布2026年夏季开放模型状态报告。报告显示前沿模型规模持续扩大,但小模型仍主导实际部署。Qwen在本地推理使用量上排名第一,Gemma位居第二。AI代理已成为HuggingFace Hub上的重要增长动力。行业HuggingFaceQwenGemma推荐理由:HuggingFace出了份开放模型夏季报告,告诉你哪些小模型最常用,Qwen和Gemma谁跑得靠前,搞本地部署前先看看。原文稍后读已读值得跟进有用关注 HuggingFace
18:02IT之家(博客/媒体)71°Mistral AI 于8月11日宣布平台将支持第三方开放模型,首个接入的是智谱 GLM-5.2。第三方模型将与第一方模型共享基础设施、区域控制和服务承诺。用户可选择在美国或欧洲区域运行 AI 推理负载,以更好地满足数据跨境合规要求。Mistral 还启动了优先层级公开预览及“欧洲计算单元”联盟计划,用于支持欧洲算力基础设施建设。AI产品Mistral AI智谱GLM-5.2开放模型推荐理由:Mistral AI 把智谱 GLM-5.2 放进自家平台了,还能选美国或欧洲跑推理,欧洲客户合规更省心。原文稍后读已读值得跟进有用关注 Mistral AI
16:23AI Will@FinanceYF5文章指出闭源实验室可能守住最前沿能力,开放模型则承接大部分日常需求。当模型能力足够好时,价格、可靠性、数据和行业经验比多几分能力更重要。AI的护城河或许不在权重里,而在尚未被发现和记录的现实信息中。行业AI护城河开放模型闭源实验室推荐理由:这篇观点挺有意思,说AI竞争到最后拼的不是模型多强,而是谁掌握更多现实数据。原文稍后读已读值得跟进有用关注 AI护城河
00:39Fireworks AI@FireworksAI_HQ72°Fireworks AI发布K3模型,称其为世界首个3万亿参数级别的开放前沿模型。K3可在Fireworks平台上运行、训练并投入实际应用。官方将于太平洋时间8月4日上午10点举办网络研讨会,由jamesr66a和Prof_OZ主讲,演示具体操作。AI模型K3Fireworks AI开放模型推荐理由:Fireworks AI说K3是首个3万亿参数的开放模型,能跑能训练。8月4号上午10点有直播演示,可以去听。原文稍后读已读值得跟进有用关注 K3
01:53官方账号Andrew Ng@AndrewYNg精选72°Nvidia CEO黄仁勋发表公开信,认为攻击者已拥有前沿AI,防御者需要一个包含开放和封闭模型的前沿AI生态系统。Andrew Ng转发并指出,在OpenAI-Hugging Face安全事件中,封闭AI阻止了关键取证,而开放权重模型帮助控制了入侵。两人共同批评封闭模型更安全的说法是监管捕获,并推动成立Open Secure AI Alliance。行业NvidiaJensen HuangAndrew Ng10 个信源在谈事件专题推荐理由:黄仁勋和Andrew Ng一起喊话:别信封闭模型更安全的鬼话。Hugging Face被黑那次,开放模型反而帮了大忙。原文稍后读已读值得跟进有用关注 Nvidia
01:43Genspark@genspark_aiGenspark AI在X平台发文支持开放权重模型。他们认为没有单一模型在所有任务上表现最好。实际工作流需要根据不同阶段的能力、经济性和控制要求灵活选择模型。开放权重使这种灵活性成为可能,并能保持AI生态的竞争性。行业Genspark AI开放模型开源权重1 个信源在谈事件专题推荐理由:Genspark AI出来表态支持开源模型了,说开放权重才能让开发者按需选模型,生态才健康。原文稍后读已读值得跟进有用关注 Genspark AI
01:38elvis@omarsar0Kimi K3 成为首个 3 万亿参数级别的开放前沿模型,现已登陆 Fireworks AI 平台。该模型支持 1M 上下文长度、原生视觉功能和推理能力,性能可媲美顶级闭源模型。Fireworks 提供基于美国服务器的推理与训练服务,并承诺零数据留存。开发者可利用 LoRA 适配器对 Kimi K3 进行高效微调。AI模型Kimi K3Fireworks开放模型10 个信源在谈事件专题推荐理由:Fireworks 上线 Kimi K3,3万亿参数开放模型,1M上下文还带视觉和推理,能微调,赶紧试试。原文稍后读已读值得跟进有用关注 Kimi K3
12:12@JensenHuang@JensenHuang78°NVIDIA CEO黄仁勋发布首条推文,分享一封由NVIDIA签署的公开信,强调开放模型的重要性。信中指出开放模型能增强安全与网络安全、加速创新与扩散、并支持国家主权。黄仁勋认为世界既需要前沿封闭模型,也需要前沿开放模型。行业NVIDIA黄仁勋开放模型10 个信源在谈事件专题推荐理由:NVIDIA老大黄仁勋发话了,说开放模型对安全、创新和主权都好,两边都要有。原文稍后读已读值得跟进有用关注 NVIDIA
08:39官方账号Jim Fan@jimfan76°NVIDIA CEO黄仁勋发布推文,分享一封由NVIDIA签署的公开信,强调开放模型(open models)在AI发展中的关键作用。信中提出开放模型能增强安全性和网络安全,加速创新与扩散,并支持国家主权。信中还指出世界需要前沿闭源模型和前沿开放模型共存。该公开信链接至NVIDIA官网PDF。行业NVIDIA开放模型开源模型10 个信源在谈事件专题推荐理由:NVIDIA亲自下场挺开放模型,讲清了为什么开放和闭源都得要,AI从业者值得看看他们的立场。原文稍后读已读值得跟进有用关注 NVIDIA
01:44官方账号Clement Delangue@ClementDelangue82°NVIDIA CEO黄仁勋在首条推文中分享公司签署的公开信。信中指出开放模型能加强安全和网络安全,加速AI创新与扩散,并支持国家主权。信件强调世界既需要前沿封闭模型,也需要前沿开放模型。行业Jensen HuangNVIDIA开放模型10 个信源在谈事件专题推荐理由:看看NVIDIA和Jensen Huang为什么公开支持开放模型,涉及安全、创新和主权,值得关注。原文稍后读已读值得跟进有用关注 Jensen Huang
01:17Julien Chaumond@julien_cNVIDIA CEO Jensen Huang签署公开信,强调开放模型对AI行业的重要性。信中称开放模型能增强安全性和网络安全,加速创新和扩散,并支持各国实现技术主权。文件指出世界既需要前沿封闭模型,也需要前沿开放模型。行业NVIDIAJensen Huang开放模型10 个信源在谈事件专题推荐理由:黄仁勋刚发贴就签了公开信,力挺开放模型。他说开放模型能让AI更安全、创新更快、各国更有主权。想理解大厂立场可以看看。原文稍后读已读值得跟进有用关注 NVIDIA
00:34ollama@ollama83°Ollama发布推文,转发NVIDIA CEO Jensen Huang签署的公开信,力挺开放模型。公开信指出开放模型能加强安全、加速创新并支持主权,认为世界需要前沿封闭模型与开放模型共存。该推文获得60个赞和7个转发,凸显社区关注。行业OllamaNVIDIAJensen Huang10 个信源在谈事件专题推荐理由:NVIDIA老大Jensen Huang亲自发文挺开放模型,Ollama转发,说了开放模型为啥跟封闭模型一样重要,还附了公开信链接。原文稍后读已读值得跟进有用关注 Ollama
04:51官方账号Allen AI (Ai2)@allen_aiAi2 的研究人员将于 7 月 30 日在 SeattleTechWeek 举办专题讨论,分享其开放模型背后的深度技术工作。讨论将涵盖构建前沿 AI 系统所需的数据、训练和推理等具体挑战。活动面向技术社区,旨在透明化开放模型的研发流程。Ai2 此前已发布一系列开放模型,如 OLMo,此次机会难得。行业Ai2开放模型SeattleTechWeek推荐理由:想了解顶尖 AI 模型是怎么造出来的?Ai2 团队在 SeattleTechWeek 直播拆解开放模型的技术细节,很硬核。原文稍后读已读值得跟进有用关注 Ai2
12:01小互@imxiaohu月之暗面发布 Kimi K3,参数规模达 3 万亿,成为全球首个该量级的开放模型。在多项评分中,K3 不及闭源模型 Claude Fable 5 和 GPT 5.6 Sol,但与 GPT 5.5 和 Opus 4.8 水平相当。定价方面,K3 输入 $3.00/M tokens,输出 $15.00/M tokens,较上一代 K2.6 上涨 2-3 倍。AI模型Kimi K3月之暗面开放模型10 个信源在谈事件专题推荐理由:月之暗面新出的Kimi K3是首个3万亿参数的开放模型,虽然比不上Claude Fable 5和GPT 5.6 Sol,但和GPT 5.5差不多,价格也涨了不少。原文稍后读已读值得跟进有用关注 Kimi K3
02:20techcrunch@Connie LoizosThinking Machines推出其首个公开开放模型Inkling,强调针对特定场景优化而非通用能力。公司经过一年半的幕后开发,首次展示技术方向。Inkling采用与主流大语言模型不同的架构,聚焦企业特定任务效率。该模型目前以开源形式发布,允许开发者定制。AI模型Thinking MachinesInkling开放模型10 个信源在谈事件专题推荐理由:Thinking Machines终于亮出了首款开放模型Inkling,主打专精不搞一刀切,和GPT这类通用模型路线很不一样,值得看看。原文稍后读已读值得跟进有用关注 Thinking Machines
23:42Fireworks AI@FireworksAI_HQ精选76°LangChain 与 NVIDIA 合作推出 Deep Agents,基于 Nemotron 3 Ultra 开放模型。该智能体成本仅为封闭模型的十分之一。用户可在 Fireworks 上运行,并进行后训练定制化。最终得到专属的专用智能体。AI模型LangChainNVIDIA Nemotron 3 UltraFireworks10 个信源在谈事件专题推荐理由:LangChain 和 NVIDIA 搞了个开放智能体,成本是封闭模型的1/10,还能自己后训练定制,挺实用的。原文稍后读已读值得跟进有用关注 LangChain
11:11官方账号Together AI@togethercompute精选Together Compute数据显示,开放模型在AI Token使用中的占比在一年内从10%增长至30%。该公司创始人分析,转向开放、模块化AI的趋势由成本、灵活性和生态驱动。这一变化表明行业对开放模型的接受度显著提升。行业Together Compute开放模型开源模型推荐理由:开放模型一年翻了三倍,从10%冲到30%的AI Token。Together Compute的数据说明开源势头真的猛。原文稍后读已读值得跟进有用关注 Together Compute
11:00官方账号Together AI@togethercomputeNVIDIA的开放模型Nemotron 3 Ultra在Together AI上线后迅速获得社区青睐。该模型在OpenRouter平台上的处理量在几天内达到每天350亿token。这反映了社区对快速、高效且可定制开放模型的积极支持。Nemotron 3 Ultra是一款完全可定制的开放模型,由NVIDIA开发。AI模型Nemotron 3 UltraNVIDIATogether AI6 个信源在谈事件专题推荐理由:NVIDIA刚推的Nemotron 3 Ultra在Together AI上火了,几天就在OpenRouter冲到每天350亿token用量,社区超爱这种又快又省又好改的开放模型。原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
02:34Harrison Chase@hwchase17Prime Intellect 宣布完成1.3亿美元A轮融资,由 Radical Ventures 领投,NVIDIA、Intel Capital、Dell Capital 及现有投资者跟投。该公司将利用资金构建开放超级智能堆栈(Open Superintelligence Stack),使用户能自主训练、部署并持续改进模型。此轮融资将用于加速平台开发与生态扩展。行业Prime Intellect融资超级智能堆栈8 个信源在谈事件专题推荐理由:Prime Intellect 融了1.3亿美元,NVIDIA和Intel都跟投了。他们要搞开放的超级智能堆栈,让你自己训练和部署模型,不用依赖大厂。原文稍后读已读值得跟进有用关注 Prime Intellect
13:52官方账号Together AI@togethercompute开放模型推动AI栈走向模块化,模型、API、工具和推理各自独立进步。Together AI认为开放模型的价值远超定价优势,正在构建模块化推理层。这种架构让不同组件可以独立优化,降低整体AI应用成本。行业开放模型Together AI推理层推荐理由:Together AI聊开放模型不是拼价格,而是拼模块化。他们正在做AI推理层,让模型、工具自由组合。原文稍后读已读值得跟进有用关注 开放模型
13:51官方账号Together AI@togethercomputeTogether AI 宣布其处理 token 量已达 400 万亿,认为这标志着开放模型在真实生产中进入规模采用阶段。团队将实际工作负载迁移到开放模型,是为了获得前沿质量、更好的 tokenomics 和更强的推理控制力。Together AI 提供基础设施支持这一转型。行业Together AI开放模型tokenomics推荐理由:400万亿 token 的量级,说明开放模型在真实生产里站稳了,看 Together AI 怎么搭台子。原文稍后读已读值得跟进有用关注 Together AI
13:49Ethan Mollick@emollickAA-Briefcase评分由@ArtificialAnlys发布,用于衡量AI完成多周复杂咨询任务的能力。最新得分曲线显示,AI模型在短期内取得了快速进步。开放权重模型与封闭模型之间存在明显的差距,封闭模型整体表现更优。该评测揭示了当前AI在多步骤复杂任务中的能力差异。AI模型AA-Briefcase开放模型封闭模型推荐理由:新评测让AI做多周复杂咨询,结果看到开放模型和封闭模型差距挺大,进步也很快。原文稍后读已读值得跟进有用关注 AA-Briefcase
12:25Fireworks AI@FireworksAI_HQFactoryAI 将模型管理平台标准化为 Fireworks,实现部署扩展。此举带来开放模型增长 2-3 倍,每美元工作量提升 5-15 倍,并能第一时间获取新开放权重模型。团队负责人 Leo Tchourakov 在视频中详解了具体实现。技巧FireworksFactoryAI开放模型推荐理由:想提升AI模型部署效率?看看FactoryAI怎么用Fireworks实现5-15倍成本效益,还能第一时间用上新模型。原文稍后读已读值得跟进有用关注 Fireworks
18:43官方账号Together AI@togethercomputeTogether AI 在推文中指出,当团队运行数十亿 tokens 时,缓存、吞吐量和服务效率的微小差异会转化为产品级的经济性。以 MiniMax M3 模型为例,该模型在 Together AI 平台上提供前沿品质和开放模型经济学,其服务栈专为规模化设计。这体现了开放模型在生产中的实际成本竞争力。AI模型MiniMax M3Together AI开放模型2 个信源在谈事件专题推荐理由:看看 Together AI 怎么用 MiniMax M3 把开放模型做大,跑几十亿 tokens 还省钱。不是吹概念,是实打实的缓存和吞吐量优化。原文稍后读已读值得跟进有用关注 MiniMax M3
18:42官方账号Together AI@togethercomputeTogether AI的James Zou与NVIDIA的Venkat Srinivasan将于7月1日在AI Engineer World's Fair上讨论开放模型如何实现集体智能。该活动聚焦开源模型在协作智能系统中的作用。演讲将结合两家公司的技术实践,分析开放模型对多智能体架构的影响。行业Together AINVIDIA开放模型6 个信源在谈事件专题推荐理由:想了解开放模型怎么支撑多智能体协作?Together AI和NVIDIA的人要聊这个,7月1日别错过。原文稍后读已读值得跟进有用关注 Together AI
03:28lmarena.ai@lmarena_aiAgent Arena 是一个智能体性能排行榜,现已在 arena.ai/leaderboard/ag... 上线。用户可通过按开放模型或按实验室(lab)筛选来查看详细数据。该排行榜为不同智能体模型提供了直接的性能对比基准。AI模型Agent Arena智能体排行榜推荐理由:想比对比不同智能体模型?去Agent Arena排行榜,能按开放模型或实验室筛选,帮你找到合适的。原文稍后读已读值得跟进有用关注 Agent Arena
04:04官方账号Together AI@togethercompute精选Trajectory Labs 在 Together Compute 和 NVIDIA 的支持下,仅用不到 24 小时就在一个开放模型上实现了前沿模型级别的性能。这展示了当优秀开源模型与合适的训练基础设施结合时,可以快速取得显著成果。Together Compute 为此提供了算力支持,凸显了开放模型生态的潜力。AI模型开放模型后训练算力基础设施10 个信源在谈事件专题推荐理由:对于关注开源模型训练效率的团队,这个案例证明了 24 小时内就能让开放模型达到前沿水平,值得研究其训练流程。原文稍后读已读值得跟进有用关注 开放模型
11:51Latent.Space@latentspacepod精选Sarah Guo 在最新一期 AINews 中提出了一个关键框架,区分了“模型实验室”和“智能体实验室”的不同发展方向,并探讨了开放模型的重要性。她认为,理解什么是“不可训练”的——即那些无法通过更多数据或算力解决的问题——对于决定投入方向至关重要。这一观点被视为当前 AI 领域最有价值的思考之一,帮助从业者明确哪些工作真正值得投入。行业开放模型智能体模型实验室推荐理由:Sarah Guo 的框架帮你分清“模型”和“智能体”两条路,做 AI 战略或投资的团队值得一读,看完能少走弯路。原文稍后读已读值得跟进有用关注 开放模型
06:13Sundar Pichai@sundarpichai78°Google 发布了 DiffusionGemma,这是一个基于 Gemma 4 的实验性开放模型,采用文本扩散技术。与传统逐词预测不同,DiffusionGemma 能同时生成整段文本,实现高达 4 倍的推理加速。该模型目前以研究预览形式开放,旨在探索更高效的文本生成方式。这对于需要低延迟文本生成的场景(如实时对话、内容创作)具有重要意义。AI模型文本扩散推理加速Gemma 47 个信源在谈事件专题推荐理由:推理速度提升 4 倍意味着更低的延迟和更低的成本,做实时文本生成或大规模内容生产的团队值得关注这个新方向。原文稍后读已读值得跟进有用关注 文本扩散
03:03Google AI Developers@googleaidevs72°Google 发布了 DiffusionGemma,一款基于文本扩散技术的实验性开放模型,采用 Apache 2.0 许可证。该模型通过将瓶颈从内存带宽转移到原始计算,在专用 GPU 上实现高达 4 倍的 token 输出速度。推理时仅激活 3.8B 参数,量化后可在 24GB VRAM 的高端消费级 GPU 上运行。它支持并行 token 生成和自我纠正,特别适合代码填充、内联编辑和非线性结构任务。DiffusionGemma 优先考虑速度而非原始质量,在计算受限的硬件上加速效果最佳,而标准 Gemma 4 仍推荐用于生产环境和内存受限设备。AI模型文本扩散开放模型Google推荐理由:DiffusionGemma 把文本生成速度推到了新高度,做代码补全、实时编辑的开发者可以直接在消费级 GPU 上体验 4 倍加速,值得一试。原文稍后读已读值得跟进有用关注 文本扩散
00:39官方账号Google DeepMind@GoogleDeepMindGoogle DeepMind 推出实验性开放模型 DiffusionGemma,采用块级文本生成技术,不再逐词预测,而是同时生成整段文本。该模型在专用 GPU 上输出速度提升高达 4 倍,并能实时自我修正和格式化复杂 Markdown。这标志着文本生成范式的转变,尤其适合需要快速、高质量输出的场景。AI模型DiffusionGemma文本生成块级生成推荐理由:做文本生成或需要快速格式化 Markdown 的开发者,可以试试这个块级生成模型,速度提升明显且能自我纠错,值得关注。原文稍后读已读值得跟进有用关注 DiffusionGemma
02:36官方账号NVIDIA AI@NVIDIAAINVIDIA 宣布其 Nemotron Coalition 新增三家成员:@hcompany_ai、@NousResearch 和 @PrimeIntellect。该联盟旨在协作开发前沿开放模型,现有成员包括 Black Forest Labs、Cursor、LangChain、Mistral AI 等。Nemotron 3 Ultra 模型已在联盟成员贡献下完成开发,未来将继续合作推进新模型发布。Prime Intellect 表示将贡献其强化学习基础设施,帮助扩展智能体能力。行业NVIDIANemotron开放模型10 个信源在谈事件专题推荐理由:开放模型生态再添生力军,做 AI 模型训练或智能体开发的团队值得关注——联盟协作模式可能加速下一代开源模型落地。原文稍后读已读值得跟进有用关注 NVIDIA
00:03官方账号LangChain@LangChainAI76°LangChain 宣布原生支持 NVIDIA 最新发布的 Nemotron 3 Ultra 模型,并在发布当天即提供对 Deep Agents 的支持。Nemotron 3 Ultra 是一个 550B 参数的 MoE 架构开放模型,专为长时间运行的智能体任务设计,推理速度提升 5 倍,复杂智能体任务成本降低 30%。作为 Nemotron Coalition 成员,LangChain 将与 NVIDIA 合作,推动开放模型的共享与构建。这一集成让开发者能立即在 LangChain 生态中使用该模型构建高性能智能体应用。AI产品LangChainNVIDIA Nemotron 3 Ultra智能体10 个信源在谈事件专题推荐理由:做智能体应用的开发者可以立即在 LangChain 中调用 Nemotron 3 Ultra,推理快 5 倍、成本降 30%,值得直接上手试。原文稍后读已读值得跟进有用关注 LangChain