14:03elvis@omarsar0Sakana AI推出Fugu Ultra模型,这是一个可通过单个API调用的多智能体编排系统。Fugu Ultra在3D渲染任务上表现极佳,性能与Fable和Mythos相当,同时避免了出口管制风险。该模型展示了无需受限制即可获得前沿能力。AI模型Sakana AIFugu UltraFable推荐理由:Sakana AI的Fugu Ultra多智能体系统,3D渲染强到离谱,性能比肩Fable和Mythos,还不用怕出口管制,快去试试。原文稍后读已读值得跟进有用关注 Sakana AI
13:55Geek@geekbb精选百度开源了一个基于DeepSeek-OCR升级的视觉语言模型OCR项目,支持一次性解析超长文档。该模型提供两种推理模式:gundam模式用于处理单张图片中的密集文字,base模式适用于多页文档或PDF。项目代码已在GitHub上发布,允许开发者直接使用。AI模型百度DeepSeek-OCR视觉语言模型推荐理由:百度开源的OCR模型,在DeepSeek-OCR上做了升级,能一次性处理超长文档和密集文字,两种模式很实用。原文稍后读已读值得跟进有用关注 百度
10:33berryxia@berryxia百度开源的 Unlimited OCR 模型采用 R-SWA 注意力机制,支持 32K 上下文窗口,一次前向推理即可完成几十页文档的转录。其核心卖点是 One-Shot Long-Horizon Parsing,无需分页处理,KV Cache 大小恒定。技术报告提到该模型融合了来自 DeepSeek-OCR 的高压缩编码器,且部分核心贡献者与 DeepSeek 有渊源。AI模型Unlimited OCR百度R-SWA6 个信源在谈事件专题推荐理由:百度搞了个挺牛的 OCR 模型,能一口气读几十页,不像以前那样一页一页循环。开源了,谁都能试试。原文稍后读已读值得跟进有用关注 Unlimited OCR
08:05berryxia@berryxia百度开源了Unlimited OCR模型,采用R-SWA(参考滑动窗口注意力)机制,一次前向推理即可处理32K上下文的文档,数十页PDF无需分块。与传统逐页处理的OCR不同,其KV Cache大小恒定,不随长度增长。模型灵感源于人类抄书行为,仅维护近128个状态。技术报告核心贡献者中,技术总监YY疑为DeepSeek前员工。AI模型Unlimited OCR百度DeepSeek6 个信源在谈事件专题推荐理由:百度开源的Unlimited OCR能一口气读完几十页PDF,不用切块,快又准。技术总监YY可能是DeepSeek出走的,有意思。原文稍后读已读值得跟进有用关注 Unlimited OCR
03:24elvis@omarsar0精选Sakana AI推出Fugu Ultra多智能体编排系统,通过单一模型API即可调用。在程序化地形生成(Three.js)测试中,Fugu Ultra一次生成效果与Fable和Mythos相当。该模型规避了出口管制风险,属于前沿能力级别。AI模型SakanaFugu Ultra智能体推荐理由:Sakana AI悄悄上了个Fugu Ultra,多智能体编排直接一个API搞定,性能追上Fable和Mythos,还不用怕出口管制,值得试试。原文稍后读已读值得跟进有用关注 Sakana
02:43官方账号SiliconFlowAI@siliconflowaiGLM-5.2 在 Designarena 的 HTML Web Design 排行榜上取得第一,超越了此前长期占据榜首的 Claude Opus 4.6 和 4.7。该模型已通过 SiliconFlow API 提供使用。开发者可以立即调用 GLM-5.2 构建 HTML 网页设计项目。AI模型GLM-5.2Claude OpusSiliconFlow1 个信源在谈事件专题推荐理由:HTML 设计排行榜上 GLM-5.2 干掉了 Claude,现在就能用 SiliconFlow 的 API 上手,写网页贼快。原文稍后读已读值得跟进有用关注 GLM-5.2
02:26官方账号LangChain@LangChainAILangChain 宣布其通用开发者工具 dcode 现已支持 GLM 5.2 模型。用户可直接在 dcode 中运行该开源模型,无需额外配置。dcode 是提供商无关的工具,也兼容其他最新的开源模型。详情可查阅 LangChain 文档。AI模型GLM 5.2dcodeLangChain推荐理由:LangChain 出了个叫 dcode 的工具,现在能跑 GLM 5.2 模型了,而且是开源的,想尝鲜直接上手。原文稍后读已读值得跟进有用关注 GLM 5.2
00:47berryxia@berryxia精选72°百度在Hugging Face上开源了Unlimited-OCR模型,其核心创新是R-SWA(Reference Sliding Window Attention),让KV Cache保持恒定,避免随页数爆炸。该模型可一次性解析单张图或多页PDF,在OmniDocBench上获得93分,比DeepSeek-OCR高出6个百分点。它取代了传统“分块+拼接”流程,实现端到端长文档理解,输出质量更高。AI模型Unlimited-OCR百度OmniDocBench5 个信源在谈事件专题推荐理由:百度开源了Unlimited-OCR,几百页文档一次搞定,不用分块拼接,速度稳准狠,OmniDocBench上93分压了DeepSeek-OCR一头。原文稍后读已读值得跟进有用关注 Unlimited-OCR
00:23AK@_akhaliqPerceptionDLM是一个新提出的多模态扩散语言模型,能够并行地感知图像中的多个区域。该模型结合了扩散模型的生成能力和语言模型的推理能力,支持多区域联合理解。它在一系列视觉定位和区域描述任务上展示了优越性能,但具体基准名称和数值未在原文中提及。AI模型PerceptionDLM多模态扩散语言模型推荐理由:这是一个新模型,能用多模态扩散语言模型同时理解图片里的多个区域,跟以前的单区域方法不一样。原文稍后读已读值得跟进有用关注 PerceptionDLM
20:53Guillermo Rauch@rauchgSakana 公司发布 Fugu Ultra 模型,通过 Vercel 的 AI Gateway 提供调用。该模型被描述为 Mythos-class(神话级)智能。用户只需一次 API 调用即可访问,背后由多个模型组成。目前已在 Vercel AI Gateway 上线。AI模型SakanaFugu UltraVercel推荐理由:Sakana 的 Fugu Ultra 模型上线 Vercel 了,一次调用就能用上多个模型,号称神话级智能,想尝鲜的可以试试。原文稍后读已读值得跟进有用关注 Sakana
15:27AI Will@FinanceYF5该视频记录了Mntruell在Compile会议上宣布Cursor新模型的完整过程。视频未透露模型版本号或基准测试结果,只展示了发布现场。观众可通过视频了解新模型的基本定位和功能方向。AI模型CursorMntruellCompile3 个信源在谈事件专题推荐理由:想第一时间知道Cursor新发布什么模型?这是Mntruell在Compile上的完整宣布视频,直接看干货。原文稍后读已读值得跟进有用关注 Cursor
14:27The Rundown AI@therundownai精选73°日本Sakana AI发布了Fugu和Fugu Ultra模型。Fugu Ultra采用多智能体编排系统,整合多种模型协同工作。在多个基准测试中,Fugu Ultra达到Fable和Mythos模型的性能水平。模型通过单一API提供,声称可规避出口管制风险。AI模型Sakana AIFuguFugu Ultra推荐理由:Sakana AI搞了个新玩法,用多个小模型组团干活,性能追平Fable和Mythos,还不用怕出口限制,搞AI的值得看看。原文稍后读已读值得跟进有用关注 Sakana AI
12:24官方一手歸藏(guizang.ai)@op7418Anthropic已训练完成更强版本的Mythos模型,可能命名为Mythos 5.1或Mythos 6。目前不确定是否会公开发布或仅用于内部加速开发。消息称停止发布Fable 5或Mythos 5不会减慢进展,反而释放资源。竞争压力来自开源模型如GLM-5.2,迫使前沿实验室持续训练更强系统。AI模型AnthropicMythosGLM-5.28 个信源在谈事件专题推荐理由:有人说Anthropic偷偷训了个更强的Mythos,但可能不对外放。想了解AI前沿动态可以看看。原文稍后读已读值得跟进有用关注 Anthropic
06:54@koltregaskes@koltregaskes据传闻,GPT-5.6将在前端开发方面有显著提升,类似于Claude Design的Codex设计工具。5.6和5.6 Pro版本可能在下周四发布。同时,用户也在期待Sonnet 5和Gemini 3.5 Pro的更新。AI模型GPT-5.6Sonnet 5Gemini 3.5 Pro推荐理由:GPT-5.6据说前端开发更强了,还有5.6 Pro,下周四可能发布。原文稍后读已读值得跟进有用关注 GPT-5.6
03:49@koltregaskes@koltregaskesX用户koltregaskes分享的截图显示,ChatGPT在一段对话中回复需要更多时间进行检查,暗示GPT-5.6可能引入更严格的安全机制。目前OpenAI官方未对此消息确认。GPT-5.6是传闻中的下一代模型,但具体发布时间与功能细节仍未公布。AI模型GPT-5.6OpenAIAI安全10 个信源在谈事件专题推荐理由:OpenAI可能推出的GPT-5.6会增加安全检查,想提前了解变化可以看看这个讨论。原文稍后读已读值得跟进有用关注 GPT-5.6
03:49@koltregaskes@koltregaskesAnthropic正在准备更新Claude Mythos模型,版本可能从当前跳至5.1。升级到版本6的可能性较低,除非Sonnet和Opus也同步升级。目前尚不确定是否公开发布。AI模型AnthropicClaude Mythos5.110 个信源在谈事件专题推荐理由:Anthropic又在迭代模型了,这次可能是Mythos 5.1,跟Sonnet和Opus版本联动,不知道会不会公开。原文稍后读已读值得跟进有用关注 Anthropic
00:42@koltregaskes@koltregaskes78°X用户koltregaskes发现字符串"claude-sonnet-5"出现在某个位置,暗示Anthropic可能即将发布新模型。Claude Sonnet系列是Anthropic的中端模型,上一代为Claude Sonnet 4(2024年发布)。本次发现意味着Sonnet 5可能已在内部测试或即将进入公开阶段。目前Anthropic尚未官方确认该模型的存在或发布时间线。AI模型Claude Sonnet 5Anthropic模型更新10 个信源在谈事件专题推荐理由:有用户在X上扒到了Claude Sonnet 5的名字,说明Anthropic可能马上要出新模型了,关注Claude的朋友可以看看这个线索。原文稍后读已读值得跟进有用关注 Claude Sonnet 5
17:54shao__meng@shao__meng社交媒体上发起LLM对比投票,比较GLM-5.2和Gemini 3.5 Flash。投票结果倾向GLM-5.2,用户认为Gemini 3.5 Flash表现不佳。评论指出Google DeepMind自Gemini 3.0多模态发布后缺乏亮眼进展。讨论焦点集中在国产模型与Google模型的性能差距。AI模型GLM-5.2Gemini 3.5 FlashGoogle DeepMind推荐理由:看看大家投票选GLM-5.2还是Gemini 3.5 Flash,很多人觉得Gemini近期的模型不太能打。原文稍后读已读值得跟进有用关注 GLM-5.2
15:25@koltregaskes@koltregaskesGLM-5.2 在 DeepSWE 编程基准上取得 44% 的得分,超过 Kimi-K2.7 Code,成为目前最强的开源模型。不过它的运行成本更高,且每次输出更多 tokens。与封闭模型相比,Claude Fable 5 以 70% 的得分领先,差距明显。AI模型GLM-5.2Kimi-K2.7DeepSWE推荐理由:智谱的 GLM-5.2 代码上刚赢了 Kimi 的 K2.7,但更贵输出也更多,离顶级闭源还有距离。原文稍后读已读值得跟进有用关注 GLM-5.2
15:18AI Will@FinanceYF5精选Anthropic在2月完成新模型Mythos的训练。Mythos悄然改变了整个研发节奏。过去5个月AI能力跃升部分源于Mythos。领先模型正帮助训练下一代模型,该循环已启动。AI模型MythosAnthropic推理模型8 个信源在谈事件专题推荐理由:Anthropic悄悄练成了Mythos,据说它直接改变了研发节奏,领先模型开始帮训练下一代模型了。原文稍后读已读值得跟进有用关注 Mythos
15:13Guillermo Rauch@rauchgGLM-5.2 是 zai_org 发布的新模型,在编码任务上表现极佳。网友 rauchg 在 X 上表示“几乎震惊”,认为这改变了局面。该推文获得 127 赞和 25 次分享。GLM-5.2 的编码能力被认为堪比顶级模型。AI模型GLM-5.2zai_org编程助手推荐理由:zai_org 的 GLM-5.2 在编码上强到让人震惊,跟之前版本比进步很大,值得试试。原文稍后读已读值得跟进有用关注 GLM-5.2
03:54Suhail@Suhail精选Z.ai推出GLM-5.2开源模型,采用MIT开放权重。该模型支持1M上下文窗口,在Terminal-Bench 2.1基准上得分81.0,仅比Claude Opus 4.8低几分。Perplexity CEO此前指出,中国已拥有最强开源模型DeepSeek,且美国开发者正基于其构建应用。GLM-5.2的发布进一步表明开源AI竞赛已非理论。AI模型GLM-5.2Z.aiDeepSeek推荐理由:Z.ai刚刚放出了GLM-5.2,MIT开源、100万上下文、跑分81.0,跟Claude Opus 4.8差距很小,做开源模型的得看看。原文稍后读已读值得跟进有用关注 GLM-5.2
00:53elvis@omarsar0精选GLM-5.2 在图形设计能力上据称达到 Opus 级别,同时在长期运行任务中表现良好。其训练引入了反奖励破解模块,用于解决强化学习中常见的奖励破解问题,例如模型走捷径、变懒、意图偏差等。该模块有助于提升编码代理在长周期任务中的可靠性与效果。GLM-5.2 是一个开源开放权重模型。AI模型GLM-5.2奖励破解开源模型推荐理由:GLM-5.2 据称设计和长任务都接近 Opus,关键是加了个反奖励破解机制,让模型更靠谱。原文稍后读已读值得跟进有用关注 GLM-5.2
23:55AK@_akhaliq研究人员发布了S-Agent,一个通过空间工具使用来增强空间推理能力的模型。S-Agent在虚拟环境中学习操作和使用空间工具,如旋转、移动物体等,以解决空间任务。该方法在空间智能基准测试中展现了显著的推理能力提升。AI模型S-Agent推理模型空间智能推荐理由:S-Agent教AI通过操作空间工具来推理空间关系,跟传统只靠视觉的模型不一样,值得关注。原文稍后读已读值得跟进有用关注 S-Agent
10:54shao__meng@shao__mengGLM 5.2 开源后在 X 平台获得多位国外 AI 博主称赞。智谱港股股价近期飙升,市值已超过 MiniMax 并接近小米。作者提到智谱内部运营问题和自身充值体验,但认为模型够强仍是核心。AI模型GLM 5.2智谱开源模型推荐理由:智谱开源了 GLM 5.2,国外博主都在夸,股价还涨到快赶上小米了,模型实力真的能打。原文稍后读已读值得跟进有用关注 GLM 5.2
05:55Browser Use@browser_useGLM 5.2 在 BrowserCode 基准上达到接近 Opus 级别分数,单次任务成本仅 0.18 美元。Minimax M3 取得 Sonnet 级别分数,输入价格 0.30 美元,比 DeepSeek V4 Pro 更便宜。Kimi k2.7 相比 k2.6 提升 9%,但被 M3 超越。这些开源权重模型首次在浏览器智能体任务中追平甚至超过 GPT 5.5 等闭源模型。AI模型GLM 5.2Minimax M3Kimi k2.72 个信源在谈事件专题推荐理由:智谱发了 GLM 5.2,Benchmark 接近 Opus,成本才一毛八,还有更便宜的 M3 和升级的 Kimi 2.7,做浏览器智能体有得选了。原文稍后读已读值得跟进有用关注 GLM 5.2
03:55官方账号Nous Research@NousResearchNousResearch 在推文中表示,Hermes Agent 模型当前表现优秀。AI模型Hermes AgentNousResearch智能体推荐理由:NousResearch 说他们的 Hermes Agent 现在很强,可以看看。原文稍后读已读值得跟进有用关注 Hermes Agent
03:50官方账号Nous Research@NousResearchNousResearch 在其 Hermes Agent 中引入了异步子代理功能。主代理可无需等待子代理完成即可继续工作。该功能提升了多代理协作的效率。AI模型Hermes AgentNousResearch智能体推荐理由:Hermes Agent 现在支持异步子代理了,主代理不用干等子任务结束,能同时干多件事,效率提升很明显。原文稍后读已读值得跟进有用关注 Hermes Agent
03:05官方账号Together AI@togethercompute精选MiniMax-M3 模型支持智能体携带长历史(超过百万token)、图像、视频、文档和工具输出进入上下文,显著提升多模态信息处理能力。Together 的推理优化通过改进服务路径上的 token 吞吐量,使这一能力在大规模部署时更实用。相比之前方案,每 GPU 可处理更多 token,从而降低每美元自动化工作成本。AI模型MiniMax-M3Together智能体2 个信源在谈事件专题推荐理由:MiniMax-M3 让智能体一口气带进长历史、图、视频、文档和工具输出,Together 优化后每 GPU token 翻倍,自动任务成本更低。原文稍后读已读值得跟进有用关注 MiniMax-M3
03:05官方账号Together AI@togethercompute88°OpenAI 的 GPT Image 2 模型现已在 Together AI 的 Serverless Inference 服务中上线。开发者可通过该接口将图像生成与编辑功能集成到多模态应用中。模型支持精准布局控制、可读文本生成以及参考图像引导生成。Together AI 提供无服务器推理能力,无需管理基础设施即可调用。AI模型GPT Image 2OpenAITogether AI10 个信源在谈事件专题推荐理由:OpenAI 的新图像模型 GPT Image 2 现在能用 Together AI 的无服务器接口调用了,做多模态应用时直接用它生成和编辑图片,支持布局和文字控制,挺方便。原文稍后读已读值得跟进有用关注 GPT Image 2
01:56Ate-a-Pi@svpino该博主从4月起在Mac Studio上运行gemma-4:26b处理私密文档,目前六成查询都使用该模型。它速度快且能力强,但复杂编程任务仍需专用模型。适合日常使用并避免向大型AI实验室上传数据。AI模型gemma-4:26b本地模型隐私文档推荐理由:gemma-4:26b 本地跑很香,处理私密文档不用传云端,日常六成查询够用。但写代码别指望它。原文稍后读已读值得跟进有用关注 gemma-4:26b
23:57Thomas Wolf@Thom_Wolf开源模型生态欢迎新手尝试Opus 4.8级别的模型。GLM-5.2是ZAI org发布的开放权重模型,可通过Hugging Face页面使用。多个供应商竞争价格,智能体价格便宜。模型可本地运行、微调并构建商业应用,无需许可。HuggingChat提供免费聊天界面。AI模型GLM-5.2Hugging Face开源模型推荐理由:GLM-5.2达到Opus 4.8水平,免费、可本地跑、可微调,比闭源灵活还便宜,快试试!原文稍后读已读值得跟进有用关注 GLM-5.2
18:43官方账号Together AI@togethercomputeTogether AI 在推文中指出,当团队运行数十亿 tokens 时,缓存、吞吐量和服务效率的微小差异会转化为产品级的经济性。以 MiniMax M3 模型为例,该模型在 Together AI 平台上提供前沿品质和开放模型经济学,其服务栈专为规模化设计。这体现了开放模型在生产中的实际成本竞争力。AI模型MiniMax M3Together AI开放模型2 个信源在谈事件专题推荐理由:看看 Together AI 怎么用 MiniMax M3 把开放模型做大,跑几十亿 tokens 还省钱。不是吹概念,是实打实的缓存和吞吐量优化。原文稍后读已读值得跟进有用关注 MiniMax M3
18:41官方账号Together AI@togethercompute精选Zai_org 推出其最新旗舰开源模型 GLM-5.2,支持 1M token 长上下文,可灵活调整推理思考力度。该模型在智能体编程任务上表现更强,现已通过 Together AI 提供推理服务,专为长上下文和工具密集型智能体工作负载优化。AI模型GLM-5.2Zai_orgTogether AI推荐理由:GLM-5.2 支持百万级上下文,还能控制推理深度,搞智能体编程和复杂工具链的可以试试。Together AI 上直接用。原文稍后读已读值得跟进有用关注 GLM-5.2
18:40官方账号Together AI@togethercomputeTogetherAI用Kimi K2.7 Code和Claude Fable 5各生成12个落地页。Kimi的成本仅为Claude的1/16,质量表现接近。通过设计MCP服务器提供视觉上下文后,Kimi效果更佳。这表明开源模型在落地页生成工作流中已是高性价比的实用选择。AI模型Kimi K2.7 CodeClaude Fable 5开源模型10 个信源在谈事件专题推荐理由:想低预算做落地页?试试Kimi K2.7 Code,便宜16倍效果不输Claude Fable 5,尤其配合MCP服务器更稳。原文稍后读已读值得跟进有用关注 Kimi K2.7 Code
18:39官方账号Together AI@togethercomputeTogether Compute 测试了闭源和开源模型构建小型可玩游戏的能力。结果显示,开源模型成本更低、速度更快,生成游戏质量接近闭源模型。例如,Opus 4.8 成本是 MiniMax M3 的 15 倍,GPT-5.5 是 Nemotron Ultra 的 10 倍,而 Kimi K2.7 Code 比 Opus 4.8 便宜 7 倍。AI模型Opus 4.8MiniMax M3GPT-5.55 个信源在谈事件专题推荐理由:Together Compute 实测:闭源模型贵几倍,开源做小游戏又快又便宜,质量还接近,想省钱就选开源。原文稍后读已读值得跟进有用关注 Opus 4.8
18:37官方账号Together AI@togethercompute精选Together AI分享了优化GLM 5.1推理性能的三项关键改进。他们重写了索引器的topk内核。接着融合了索引器内核以减少内存和启动开销。同时消除了限制预填充吞吐量的CPU开销。这些优化显著提升了GLM 5.1在Together AI平台上的运行效率。AI模型GLM 5.1Together AI推理优化推荐理由:想知道Together AI怎么让GLM 5.1跑得更快?他们分享了三个工程优化点,对部署GLM 5.1有直接帮助。原文稍后读已读值得跟进有用关注 GLM 5.1
18:35官方账号Together AI@togethercomputeTogether AI 上线了 Cartesia Sonic 3.5 语音模型,为开发者提供超过150种语音。通过语音查找器,开发者可以试听和比较这些语音,为实时智能体挑选最合适的角色。选定后可直接在 Together AI 平台部署,简化开发流程。AI模型Cartesia Sonic 3.5Together AI语音模型推荐理由:Together AI 集成了 Cartesia Sonic 3.5,有150多种语音可选,做实时语音智能体可以试试这个新库。原文稍后读已读值得跟进有用关注 Cartesia Sonic 3.5
18:34官方账号Together AI@togethercomputeTogether AI 部署的 DeepSeek V4 Pro 在 Artificial Analysis 基准测试中同时获得输出速度和延迟两项第一。该成绩通过优化 KV 缓存、前缀复用、内核及端点配置实现。Together AI 公开了其推理系统的具体工程方案,包括缓存策略和内核调优。AI模型DeepSeek V4 ProTogether AIArtificial Analysis1 个信源在谈事件专题推荐理由:Together AI 把 DeepSeek V4 Pro 调到了速度与延迟双第一,还公开了优化方法,搞推理部署的值得看看。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
18:33官方账号Together AI@togethercompute精选Kimi Moonshot 发布 Kimi-K2.7-Code,基于 Kimi K2.6 的专用编码智能体模型。该模型面向长周期软件工程工作流,支持工具调用和代理式推理。现已通过 Together AI 的推理栈提供,针对工具密集型编码代理场景优化。模型在多个编程基准上表现优于前代。AI模型Kimi-K2.7-Code月之暗面智能体5 个信源在谈事件专题推荐理由:月之暗面出了个专门写代码的智能体模型 K2.7-Code,在 Together AI 上就能跑,搞长期软件工程任务挺合适。原文稍后读已读值得跟进有用关注 Kimi-K2.7-Code