6月23日
14:03
14:03elvis@omarsar0
Sakana AI推出Fugu Ultra模型,这是一个可通过单个API调用的多智能体编排系统。Fugu Ultra在3D渲染任务上表现极佳,性能与Fable和Mythos相当,同时避免了出口管制风险。该模型展示了无需受限制即可获得前沿能力。
推荐理由:Sakana AI的Fugu Ultra多智能体系统,3D渲染强到离谱,性能比肩Fable和Mythos,还不用怕出口管制,快去试试。
03:24
03:24elvis@omarsar0
精选
Sakana AI推出Fugu Ultra多智能体编排系统,通过单一模型API即可调用。在程序化地形生成(Three.js)测试中,Fugu Ultra一次生成效果与Fable和Mythos相当。该模型规避了出口管制风险,属于前沿能力级别。
推荐理由:Sakana AI悄悄上了个Fugu Ultra,多智能体编排直接一个API搞定,性能追上Fable和Mythos,还不用怕出口管制,值得试试。
02:43
02:43官方账号SiliconFlowAI@siliconflowai
GLM-5.2 在 Designarena 的 HTML Web Design 排行榜上取得第一,超越了此前长期占据榜首的 Claude Opus 4.6 和 4.7。该模型已通过 SiliconFlow API 提供使用。开发者可以立即调用 GLM-5.2 构建 HTML 网页设计项目。
事件专题

推荐理由:HTML 设计排行榜上 GLM-5.2 干掉了 Claude,现在就能用 SiliconFlow 的 API 上手,写网页贼快。
02:26
02:26官方账号LangChain@LangChainAI
LangChain 宣布其通用开发者工具 dcode 现已支持 GLM 5.2 模型。用户可直接在 dcode 中运行该开源模型,无需额外配置。dcode 是提供商无关的工具,也兼容其他最新的开源模型。详情可查阅 LangChain 文档。
推荐理由:LangChain 出了个叫 dcode 的工具,现在能跑 GLM 5.2 模型了,而且是开源的,想尝鲜直接上手。
6月22日
20:53
20:53Guillermo Rauch@rauchg
Sakana 公司发布 Fugu Ultra 模型,通过 Vercel 的 AI Gateway 提供调用。该模型被描述为 Mythos-class(神话级)智能。用户只需一次 API 调用即可访问,背后由多个模型组成。目前已在 Vercel AI Gateway 上线。
推荐理由:Sakana 的 Fugu Ultra 模型上线 Vercel 了,一次调用就能用上多个模型,号称神话级智能,想尝鲜的可以试试。
15:27
15:27AI Will@FinanceYF5
该视频记录了Mntruell在Compile会议上宣布Cursor新模型的完整过程。视频未透露模型版本号或基准测试结果,只展示了发布现场。观众可通过视频了解新模型的基本定位和功能方向。
事件专题

推荐理由:想第一时间知道Cursor新发布什么模型?这是Mntruell在Compile上的完整宣布视频,直接看干货。
14:27
14:27The Rundown AI@therundownai
精选73°
日本Sakana AI发布了Fugu和Fugu Ultra模型。Fugu Ultra采用多智能体编排系统,整合多种模型协同工作。在多个基准测试中,Fugu Ultra达到Fable和Mythos模型的性能水平。模型通过单一API提供,声称可规避出口管制风险。

推荐理由:Sakana AI搞了个新玩法,用多个小模型组团干活,性能追平Fable和Mythos,还不用怕出口限制,搞AI的值得看看。
06:54
03:49
6月21日
15:25
15:25@koltregaskes@koltregaskes
GLM-5.2 在 DeepSWE 编程基准上取得 44% 的得分,超过 Kimi-K2.7 Code,成为目前最强的开源模型。不过它的运行成本更高,且每次输出更多 tokens。与封闭模型相比,Claude Fable 5 以 70% 的得分领先,差距明显。

推荐理由:智谱的 GLM-5.2 代码上刚赢了 Kimi 的 K2.7,但更贵输出也更多,离顶级闭源还有距离。
15:18
15:13
6月20日
10:54
03:55
03:50
03:05
03:05官方账号Together AI@togethercompute
88°
OpenAI 的 GPT Image 2 模型现已在 Together AI 的 Serverless Inference 服务中上线。开发者可通过该接口将图像生成与编辑功能集成到多模态应用中。模型支持精准布局控制、可读文本生成以及参考图像引导生成。Together AI 提供无服务器推理能力,无需管理基础设施即可调用。
事件专题

推荐理由:OpenAI 的新图像模型 GPT Image 2 现在能用 Together AI 的无服务器接口调用了,做多模态应用时直接用它生成和编辑图片,支持布局和文字控制,挺方便。
01:56
6月19日
18:43
18:43官方账号Together AI@togethercompute
Together AI 在推文中指出,当团队运行数十亿 tokens 时,缓存、吞吐量和服务效率的微小差异会转化为产品级的经济性。以 MiniMax M3 模型为例,该模型在 Together AI 平台上提供前沿品质和开放模型经济学,其服务栈专为规模化设计。这体现了开放模型在生产中的实际成本竞争力。
事件专题

推荐理由:看看 Together AI 怎么用 MiniMax M3 把开放模型做大,跑几十亿 tokens 还省钱。不是吹概念,是实打实的缓存和吞吐量优化。
18:41
18:41官方账号Together AI@togethercompute
精选
Zai_org 推出其最新旗舰开源模型 GLM-5.2,支持 1M token 长上下文,可灵活调整推理思考力度。该模型在智能体编程任务上表现更强,现已通过 Together AI 提供推理服务,专为长上下文和工具密集型智能体工作负载优化。

推荐理由:GLM-5.2 支持百万级上下文,还能控制推理深度,搞智能体编程和复杂工具链的可以试试。Together AI 上直接用。
18:40
18:40官方账号Together AI@togethercompute
TogetherAI用Kimi K2.7 Code和Claude Fable 5各生成12个落地页。Kimi的成本仅为Claude的1/16,质量表现接近。通过设计MCP服务器提供视觉上下文后,Kimi效果更佳。这表明开源模型在落地页生成工作流中已是高性价比的实用选择。
事件专题

推荐理由:想低预算做落地页?试试Kimi K2.7 Code,便宜16倍效果不输Claude Fable 5,尤其配合MCP服务器更稳。
18:39
18:39官方账号Together AI@togethercompute
Together Compute 测试了闭源和开源模型构建小型可玩游戏的能力。结果显示,开源模型成本更低、速度更快,生成游戏质量接近闭源模型。例如,Opus 4.8 成本是 MiniMax M3 的 15 倍,GPT-5.5 是 Nemotron Ultra 的 10 倍,而 Kimi K2.7 Code 比 Opus 4.8 便宜 7 倍。
事件专题

推荐理由:Together Compute 实测:闭源模型贵几倍,开源做小游戏又快又便宜,质量还接近,想省钱就选开源。
18:37
18:37官方账号Together AI@togethercompute
精选
Together AI分享了优化GLM 5.1推理性能的三项关键改进。他们重写了索引器的topk内核。接着融合了索引器内核以减少内存和启动开销。同时消除了限制预填充吞吐量的CPU开销。这些优化显著提升了GLM 5.1在Together AI平台上的运行效率。

推荐理由:想知道Together AI怎么让GLM 5.1跑得更快?他们分享了三个工程优化点,对部署GLM 5.1有直接帮助。
18:35
18:35官方账号Together AI@togethercompute
Together AI 上线了 Cartesia Sonic 3.5 语音模型,为开发者提供超过150种语音。通过语音查找器,开发者可以试听和比较这些语音,为实时智能体挑选最合适的角色。选定后可直接在 Together AI 平台部署,简化开发流程。

推荐理由:Together AI 集成了 Cartesia Sonic 3.5,有150多种语音可选,做实时语音智能体可以试试这个新库。
18:34
18:34官方账号Together AI@togethercompute
Together AI 部署的 DeepSeek V4 Pro 在 Artificial Analysis 基准测试中同时获得输出速度和延迟两项第一。该成绩通过优化 KV 缓存、前缀复用、内核及端点配置实现。Together AI 公开了其推理系统的具体工程方案,包括缓存策略和内核调优。
事件专题

推荐理由:Together AI 把 DeepSeek V4 Pro 调到了速度与延迟双第一,还公开了优化方法,搞推理部署的值得看看。
18:33
18:33官方账号Together AI@togethercompute
精选
Kimi Moonshot 发布 Kimi-K2.7-Code,基于 Kimi K2.6 的专用编码智能体模型。该模型面向长周期软件工程工作流,支持工具调用和代理式推理。现已通过 Together AI 的推理栈提供,针对工具密集型编码代理场景优化。模型在多个编程基准上表现优于前代。
事件专题

推荐理由:月之暗面出了个专门写代码的智能体模型 K2.7-Code,在 Together AI 上就能跑,搞长期软件工程任务挺合适。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。