6月7日
6月6日
08:03
08:03Aravind Srinivas@AravSrinivas
NVIDIA 最新的开源模型 Nemotron 3 Ultra 现已上线 Perplexity,面向所有 Pro 和 Max 用户开放。该模型专为长时间运行的智能体任务设计,是美国领先的开源模型之一。用户可以直接在 Perplexity 平台上体验其长上下文和推理能力。此举进一步丰富了 Perplexity 的模型选择,为开发者提供了更多开源选项。
事件专题

推荐理由:NVIDIA 的 Nemotron 3 Ultra 是专为长时智能体任务设计的开源模型,做 AI 智能体开发的团队可以直接在 Perplexity 上试用,省去本地部署的麻烦。
6月5日
19:26
01:18
01:18Paul Couvert@itsPaulAi
Nvidia 发布了 Nemotron 3 Ultra 开源 AI 模型,专为智能体任务和编程场景优化。该模型在推理速度上比同类模型快 5 倍,成本降低 30%,并已在 Hugging Face 上开放下载。它特别适合处理大型代码库,并支持 Hermes Agent 等智能体框架。这一发布意味着开发者可以更高效、更经济地构建 AI 智能体应用。
事件专题

推荐理由:做智能体开发或大型代码库编程的团队,终于有了一个又快又便宜的开源选择——Nemotron 3 Ultra 速度提升 5 倍、成本降低 30%,值得直接上 Hugging Face 试试。
6月4日
08:22
08:22berryxia@berryxia
Google 昨晚发布了 Gemma 4 12B 多模态大模型,该模型支持文本和图像输入,最低只需 16GB 内存即可运行。这降低了多模态模型的本地部署门槛,适合个人开发者和资源受限的环境。与 Qwen 等同类模型的对比结果值得关注,可能影响开源多模态模型的竞争格局。
事件专题

推荐理由:多模态模型本地运行门槛进一步降低,做 AI 应用或本地部署的开发者可以关注 Gemma 4 与 Qwen 的对比,评估是否值得迁移或尝试。
06:44
06:44官方账号Clement Delangue@ClementDelangue
Hugging Face CEO Clement Delangue 在 X 上发帖调侃,认为现在即使把开源模型命名为“0pus 4.8”或“GPT 5.S”放进应用,用户也会大量使用而不抱怨。他指出这是“前沿”营销的力量——品牌和命名比实际技术更能吸引用户。这条推文引发了关于 AI 行业品牌效应与真实技术差距的讨论。
推荐理由:做 AI 应用或营销的团队值得看看——品牌命名对用户认知的影响可能远超技术本身,别让“前沿”标签蒙蔽了你的判断。
03:00
03:00官方账号Decoder@Matthias Bastian
78°
Ideogram 发布了其文本到图像模型 4.0 版本,作为开源权重模型,支持原生 2K 分辨率、边界框控制和改进的文本渲染。在 DesignArena 排行榜上,它在所有开源模型中排名第一,仅落后于 OpenAI 和 Google 的闭源系统。商业使用需要付费许可。
事件专题

推荐理由:对于需要高质量图像生成且注重文本准确性的创作者和开发者,Ideogram 4.0 的开源权重版本提供了顶级性能,值得尝试。
02:01
02:01官方账号阶跃星辰 Stepfun@Stepfun_AI
StepFun 与 Modal 合作,发布了在 Modal 无服务器 AI 平台上部署 Step 3.7 Flash 模型的指南。该方案使用 8×H100 GPU、Modal Volumes 和 SGLang,提供 OpenAI 兼容的聊天补全端点。开发者无需管理基础设施即可快速部署和扩展推理工作负载。这降低了 StepFun 开源模型的使用门槛,让更多构建者能轻松调用。
事件专题

推荐理由:想低成本部署开源推理模型的团队,现在可以直接在 Modal 上跑 Step 3.7 Flash,免去 GPU 管理烦恼,还自带 OpenAI 兼容接口,建议试试。
00:32
00:32lmarena.ai@lmarena_ai
76°
Ideogram-4.0-Quality 在文生图领域成为新的开源模型第一名,在所有子类别上相比前代有巨大提升。尤其在文本渲染和产品、品牌与商业设计方面进步最为显著。该模型在公开评测中表现优异,标志着开源文生图模型质量迈上新台阶。

推荐理由:做设计或品牌营销的团队终于有了一个能打的开源文生图模型——Ideogram-4.0-Quality 在文本渲染和商业设计上进步明显,值得直接上手试试。
6月2日
22:37
22:37官方账号Nathan Lambert: Interconnects@Nathan Lambert
作者在艾伦人工智能研究所(Ai2)的最后一周,回顾了参与 Olmo 模型开发的工作经历。文章分享了在 Ai2 的成长与学习,以及如何通过 Olmo 模型产生广泛而持久的影响。这不仅是个人告别,也反映了开源 AI 研究机构的发展与挑战。

推荐理由:对于关注开源大模型和 AI 研究机构动态的从业者,这篇文章提供了 Olmo 模型背后的真实视角和行业思考,值得一读。
10:35
10:35Harrison Chase@hwchase17
精选76°
MiniMax 正式发布 M3 模型,这是首个同时具备编码、智能体能力和原生多模态的开放权重模型。在 SWE-Bench Pro 上达到 59.0%,Terminal Bench 2.1 为 66.0%,并支持 1M 上下文窗口。模型权重和技术报告将在约 10 天后公开。开发者可通过 API 和专属代码平台 code.minimax.io 使用。
推荐理由:MiniMax M3 把编码、智能体和多模态三合一开源,做 AI 应用和 Agent 开发的团队可以直接拿来用,尤其适合需要长上下文和复杂任务自动化的场景。
08:23
08:23Guillermo Rauch@rauchg
76°
MiniMax M3 在 Next.js 智能体评测中成为领先的开源模型,性能仅次于 Opus 和 GPT-5,但成本低 10 倍。这是 MiniMax 首个支持多模态输入的长上下文模型。Vercel 宣布 M3 已上线 AI Gateway,并提供一周 50% 折扣。开发者可以以极低成本获得接近顶级模型的智能体能力。
事件专题

推荐理由:做 Next.js 智能体开发的团队终于有了高性价比的开源选择——M3 性能接近 Opus 但成本仅 1/10,Vercel 用户现在就能用上,建议立刻试试。
6月1日
11:12
11:12OpenRouter@OpenRouterAI
精选76°
MiniMax 发布了 M3 模型,这是首个同时具备编码、智能体与多模态能力的开源权重模型。在 SWE-Bench Pro 上达到 59.0%,Terminal Bench 2.1 上 66.0%,并支持 1M 上下文窗口。模型原生多模态,从零开始训练,权重和技术报告将在约 10 天后公开。API 已上线 platform.minimax.io,并提供 MiniMax Code 工具。
推荐理由:MiniMax M3 把编码、智能体和多模态三个前沿能力打包进一个开源模型,做 AI 应用开发或智能体研究的团队可以直接用 API 体验,值得关注即将开源的权重。