16:42IT之家(博客/媒体)Arena平台发布第30周AI大模型排行,kimi-k3以ELO 1485分位列综合榜第11,蝉联前端开发榜全球第一。代码榜中kimi-k3以1530分排名第8,较上周上升2位,进入Top10。综合榜claude-fable-5以1508分蝉联榜首,Anthropic系列占据前6。国产模型中qwen3.7-max-preview排第20(ELO 1475),glm-5.2排第30(ELO 1469)。AI模型Kimi K3ClaudeArena10 个信源在谈事件专题推荐理由:这周国产Kimi K3真能打,前端开发全球第一,代码榜也杀进前十,跟Claude系列差距很小了。原文稍后读已读值得跟进有用关注 Kimi K3
16:21官方一手Pandaily@contact@pandaily.com (Pandaily)Lightelligence 在 WAIC 2026 上展示了全球首个实际部署的光计算系统——天书光立方门禁控制。该公司同步发布 PACE 3 光芯片,其 256x256 光子矩阵用于低延迟推理任务。该芯片已在真实场景中运行,标志光计算从实验室走向商业化。PACE 3 的光子矩阵设计相比传统电子芯片在功耗和延迟上有数量级优势。AI模型LightelligencePACE 3光子芯片推荐理由:Lightelligence 把光计算从论文带到了真实门禁系统里,PACE 3 芯片的 256x256 矩阵能跑低延迟推理,是商用落地的首个案例,值得关注。原文稍后读已读值得跟进有用关注 Lightelligence
16:15官方一手pandaily@contact@pandaily.com (Pandaily)中科院计算所发布智境(ZhiJing)社交智能系统,包含SoMBench评估基准和Zing模型。Zing在社交认知任务上超越GPT-5.5,采用FLARE自进化训练和OPD蒸馏技术。该系统使AI能理解社交情境、情绪和未言明信号。AI模型ZingGPT-5.5中科院推荐理由:中科院搞了个能懂人情世故的AI模型Zing,社交认知吊打GPT-5.5,值得一看。原文稍后读已读值得跟进有用关注 Zing
14:50IT之家(博客/媒体)谷歌CEO桑达尔·皮查伊在2026年第二季度财报电话会议上透露,Gemini 4正在训练中,投入大量资源。他承认Gemini 3.5 Pro未按计划在6月发布,且在编程、智能体等领域存在不足,希望Gemini 4能追上前沿水平。9To5Google根据以往节奏预测,Gemini 4有望在2026年11月或12月发布。AI模型Gemini 4谷歌Gemini 3.5 Pro推荐理由:皮查伊亲口确认Gemini 4已经在训练,还坦白承认了Gemini在编程和智能体上的短板,目标年底前补上差距。原文稍后读已读值得跟进有用关注 Gemini 4
11:47IT之家(博客/媒体)82°埃隆·马斯克宣布 SpaceXAI 的 Grok 4.6 模型将在两周内(截至 8 月 7 日)推出,参数规模达 2T 量级。Grok 4.6 已初步训练完成,各方面表现优于 1.5T 参数的 Grok 4.5。Grok 4.7 预计在四周内(截至 8 月 21 日)推出,具体规格尚不清楚。AI模型GrokSpaceXAI2T参数推荐理由:马斯克说 Grok 4.6 参数翻倍到 2T,马上就能用了,比上一代强,值得关注。原文稍后读已读值得跟进有用关注 Grok
11:41量子位@量子位的朋友们蚂蚁百灵发布了新一代原生混合推理模型Ling-3.0-Flash。该模型在MATH-500和HumanEval基准上取得了领先成绩,推理速度相比上一代有显著提升。它支持文本与代码等多模态输入,已通过百灵开放平台提供API。AI模型Ling-3.0-Flash蚂蚁百灵推理模型推荐理由:蚂蚁百灵出了Ling-3.0-Flash,数学和代码能力强,速度更快,开发者直接调API就能用。原文稍后读已读值得跟进有用关注 Ling-3.0-Flash
18:55官方一手marktechpost@Michal Sutter快手KwaiKAT团队发布技术报告,推出KAT-Coder-V2.5智能体编程模型,在10万个可验证仓库环境上训练。团队开发AutoBuilder工具,将环境构建成功率从16.5%提升至57.2%,覆盖12种编程语言。沙盒审计机制将强化学习反馈错误率从约16%降低至2%以下。研究指出,智能体编程能力的瓶颈在于训练基础设施而非模型规模。AI模型KAT-Coder-V2.5快手AutoBuilder推荐理由:快手开源了KAT-Coder-V2.5,用10万个可验证环境训练代码智能体。AutoBuilder把环境搭建成功率从16%拉到57%,沙盒审计又让反馈错误降到2%以下。做编程智能体训练的值得一看。原文稍后读已读值得跟进有用关注 KAT-Coder-V2.5
18:01官方账号Decoder@Matthias Bastian86°Anthropic的Claude Opus 5在ARC-AGI-3基准测试中取得30.2%的成绩,接近此前GPT-5.6 Sol记录7.8%的四倍。测试开发者指出,Opus 5是首个独立推导出反射方程的模型,这一行为此前从未在其他模型中出现。开发者认为这归因于其更强的逻辑推理能力。ARC-AGI-3被设计为衡量真实智能的测试。AI模型Opus 5GPT-5.6 SolAnthropic10 个信源在谈事件专题推荐理由:Anthropic的Opus 5在智能测试上把GPT-5.6 Sol甩开一大截,还自己学会推方程了。原文稍后读已读值得跟进有用关注 Opus 5
17:16官方一手marktechpost@Michal SutterInduction Labs 推出 Imagination Models 架构,其候选模型 Photon-1 为稀疏 106B-A5B MoE,仅在未标注动作的原始视频上完成单次预训练。Photon-1 能够模拟桌面操作、玩跳棋,并建模台球物理。该架构挑战了传统需动作标签的预训练范式。AI模型Photon-1Induction Labs世界模型推荐理由:Induction Labs 搞了个新套路:不用动作标签,只看视频就能学会模拟桌面、跳棋和台球物理。106B 参数的 MoE 模型,一次预训练就够了。原文稍后读已读值得跟进有用关注 Photon-1
16:12官方一手pandaily@contact@pandaily.com (Pandaily)腾讯 Robotics X 在 WAIC 2026 上开源三个具身基础模型:VLM 负责场景理解,RxBrain 认知模型基于视觉状态进行规划,VLA 连续动作控制频率达 500-1000Hz。首席科学家张正友解释了三层大脑架构,解决了机器人反应速度问题。这些模型分别对应感知、认知和动作层,可组合用于复杂操作任务。AI模型Tencent Robotics XVLMRxBrain推荐理由:腾讯开源了三个具身模型,像搭积木一样分层解决机器人从看懂到动起来的难题,VLA 能做到毫秒级反应,做机器人开发的一定要看看。原文稍后读已读值得跟进有用关注 Tencent Robotics X
13:37IT之家(博客/媒体)81°开发者 Eversmile1 公开了 Claude Opus 5 在 claude.ai 上的完整系统提示词,共 135027 字符(约 3.4 万 token)。提示词分三部分:30 个工具的说明书、法务合规手册(含版权引用限 15 词等规则)、以及推广自家产品的渠道。其中记忆系统规定标签只有 [stated]、禁止记录隐私信息(如健康诊断、家人名字)等严格约束。还禁止使用 genuinely、honestly、straightforward 三个词。AI模型Claude Opus 5Anthropic系统提示词10 个信源在谈事件专题推荐理由:Opus 5 的提示词被完整扒出来了,3.4 万 token 全是规矩,连记忆怎么记、什么能记不能记都写死了,看完你就知道 Anthropic 有多谨慎。原文稍后读已读值得跟进有用关注 Claude Opus 5
08:18官方一手marktechpost@Asif RazzaqSakana AI 发布了基于 Fugu 编排模型的安全调优端点 Fugu-Cyber。该模型在 CyberGym 基准上取得 86.9% 准确率,在 CTI-REALM 上达到 72.1%。其性能超过了 GPT-5.5-Cyber 和 Claude Mythos Preview。访问需要手动批准并遵循防御性使用政策及 Token 计划。AI模型Sakana AIFugu-CyberCyberGym推荐理由:Sakana AI 新出的网络安全模型 Fugu-Cyber 在 CyberGym 上拿了 86.9%,比 GPT-5.5-Cyber 还高,做安全测试的可以关注。原文稍后读已读值得跟进有用关注 Sakana AI
03:08官方一手marktechpost@Asif RazzaqReactor 团队开源了 Open Dreamer,这是一个基于 JAX 和 Flax NNX 的 Dreamer 4 世界模型管道的完整复现。该项目包含两个代码仓库:next-state/open-dreamer 提供训练管道,包括因果视频分词器、动作条件潜在动力学模型、轨迹生成和 FVD 评分;reactor-team/open-dreamer 提供推理代码。Open Dreamer 的发布使 Dreamer 4 的完整训练流程得以公开复现。AI模型Open DreamerDreamer 4JAX推荐理由:Reactor 团队把 Dreamer 4 的完整训练配方和代码都开源了,JAX/Flax 实现,想复现世界模型做视频预测的赶紧看。原文稍后读已读值得跟进有用关注 Open Dreamer
18:53官方账号Decoder@Matthias BastianAnthropic的Opus 5模型在Auto Mode下,针对浏览器智能体在129个测试场景中实现零提示注入成功率。无额外保护时成功率仅为3.7%。若实际表现一致,该模型可能解决了浏览器AI智能体最严重的安全问题。AI模型Opus 5Anthropic提示词注入10 个信源在谈事件专题推荐理由:Anthropic的Opus 5在Auto Mode下把浏览器智能体的提示注入防御做到了100%,129个测试全过,这可能彻底解决智能体安全难题。原文稍后读已读值得跟进有用关注 Opus 5
17:54官方账号Decoder@Matthias BastianAnthropic 的 Claude Opus 5 在 Artificial Analysis Intelligence Index 中获得 61 分,超过 Claude Fable 5 和 GPT-5.6 Sol。该模型在分析质量和编程基准上得分最高。其成本在更低推理层级下仅为 Fable 5 的一半。不过领先优势并不大,竞争仍然激烈。AI模型Claude Opus 5Fable 5GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Claude Opus 5 性能不输更贵的 Fable 5,编程和分析很强,性价比高,值得关注。原文稍后读已读值得跟进有用关注 Claude Opus 5
16:02官方账号Latent Space (swyx)(博客/媒体)Anthropic发布了Claude Opus 5模型,性能达到Fable级别,但定价与Opus相同,即Fable价格的一半。这表明Anthropic在模型蒸馏上具备显著优势,能将高价模型能力压缩到低价模型。该模型主要面向需要高性能低成本的推理场景。AI模型Claude Opus 5AnthropicFable10 个信源在谈事件专题推荐理由:Anthropic整了个Claude Opus 5,性能赶上Fable只卖Opus的价,蒸馏技术太猛了!原文稍后读已读值得跟进有用关注 Claude Opus 5
15:41IT之家(博客/媒体)微软 CEO 纳德拉表示,自研 MAI 系列模型在常见 Excel 任务中性能与 GPT-5.6 相当。MAI 模型在面向产品定制的强化学习环境下,通过学习真实工作流程在 GitHub Copilot 和 Excel 上取得显著进步。由于 MAI 不需要依赖最新 AI 加速器,企业可在英伟达 H100/A100 GPU 上运行,部署成本更低。纳德拉强调微软正推进“前沿扩散与控制”策略,未来企业将根据任务编排多种模型。AI模型MAIGPT-5.6微软推荐理由:微软新出的 MAI 模型,在 Excel 上比肩 GPT-5.6,而且跑在旧款显卡上就能用,成本低不少。原文稍后读已读值得跟进有用关注 MAI
13:11量子位@henryVivix推出首个实时互动模型,采用统一流式架构。单卡视频生成速度突破10000 video tokens/s。该模型打通实时多模态生成全链路,支持视频、图像、音频等模态的实时交互。相比传统非实时方案,延迟降低至毫秒级。AI模型Vivix视频生成多模态推荐理由:Vivix这个新模型单卡就能每秒生成上万视频token,做实时互动视频、多模态聊天特别带劲,比之前那些慢吞吞的方案强多了。原文稍后读已读值得跟进有用关注 Vivix
09:09官方账号Simon Willison’s Weblog(博客/媒体)精选Anthropic 的 Claude Opus 5 在提示注入(prompt injection)防护上取得显著进展。根据官方系统卡和红队评估,Opus 5 是 Anthropic 迄今最难以被成功提示注入的模型。这一结果基于多项 PI 评估和对抗测试,标志着大模型安全性的一次重要提升。AI模型ClaudeAnthropicOpus 510 个信源在谈事件专题推荐理由:Anthropic 的 Opus 5 在防提示注入上做到了史上最强,红队测试都很难攻破,安全团队值得关注。原文稍后读已读值得跟进有用关注 Claude
08:58SuperTechFans(博客/媒体)85°Anthropic 于 2026 年 7 月 24 日发布 Claude Opus 5,智能水平接近 Claude Fable 5 但价格减半。该模型支持可调努力程度,在 Frontier-Bench、CursorBench 等多项基准测试中超越前代,尤其在软件工程、知识推理和自动化任务上表现突出。Opus 5 无数据保留要求,相比 Fable 的 30 天政策更受组织欢迎。实际使用中成本低于 Sonnet,早期客户反馈在调试、根因分析和自动化工作流中达到 100% 通过率。AI模型Claude Opus 5AnthropicClaude Fable 510 个信源在谈事件专题推荐理由:Anthropic 新模型 Opus 5 智能接近 Fable 5 但价格减半,数据保留更灵活,适合团队用更少的钱获得顶尖推理能力。原文稍后读已读值得跟进有用关注 Claude Opus 5
07:57官方账号Simon Willison’s Weblog(博客/媒体)78°Anthropic 推出 Claude Opus 5,定价与 Opus 4.8 相同,并保留双倍价格的快速模式。该模型在 Artificial Analysis 排行榜上超越 Claude Fable 5。性能接近 Fable 5 但价格仅为其一半。在 Frontier-Bench 任务中,Opus 5 自主编写计算机视觉流水线,从像素图重建 3D FreeCAD 模型。在发现漏洞方面接近 Mythos 5,但未训练漏洞利用能力。AI模型Claude Opus 5Anthropic推理模型10 个信源在谈事件专题推荐理由:Anthropic 的 Claude Opus 5 性能接近 Fable 5 还便宜一半,能自己写代码做 3D 重建,很强。原文稍后读已读值得跟进有用关注 Claude Opus 5
06:46IT之家(博客/媒体)82°Anthropic 发布 Claude Opus 5,其性能接近更高规格的 Fable 5,但输入价格(5美元/百万词元)和输出价格(25美元/百万词元)仅为 Fable 5 的一半。在 Frontier-Bench v0.1 中,Opus 5 比 Opus 4.8 任务性能提升一倍以上,成本更低。在 ARC-AGI-3 测试中,Opus 5 得分约为第二名的3倍。在 CursorBench 3.2 最高努力模式下,Opus 5 与 Fable 5 差距仅0.5%,成本减半。AI模型Claude Opus 5AnthropicFable 510 个信源在谈事件专题推荐理由:Anthropic 新出的 Opus 5 跑分逼近旗舰 Fable 5,价格只要一半,ARC-AGI-3 上直接三倍杀第二名,闭眼入。原文稍后读已读值得跟进有用关注 Claude Opus 5
05:57官方一手marktechpost@Asif Razzaq82°Anthropic推出Claude Opus 5,取代Opus 4.8成为Opus系列旗舰模型。输入价格维持$5/百万token,输出价格$25/百万token。该模型智能接近Claude Fable 5但价格仅为后者一半。它支持代理编码和计算机使用功能。AI模型Claude Opus 5AnthropicClaude Fable 510 个信源在谈事件专题推荐理由:Anthropic新出的Claude Opus 5,定价和以前一样,能力却快赶上更贵的Fable 5了,特别适合搞AI编程和控制电脑。原文稍后读已读值得跟进有用关注 Claude Opus 5
02:55官方账号Decoder@Matthias Bastian74°Anthropic推出了旗舰模型Claude Opus 5,在编码和知识工作基准上取得高分。该模型在ARC-AGI-3(评估新颖问题解决能力的基准)上达到30.2%,几乎是GPT-5.6 Sol的四倍。其token价格仅为Fable 5的一半。AI模型Claude Opus 5Fable 5GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Anthropic的新模型Opus 5在推理和编程上很强,价格只有Fable 5一半,性价比高。原文稍后读已读值得跟进有用关注 Claude Opus 5
02:03官方一手AWS Machine Learning Blog@Aamna Najmi81°Anthropic宣布Claude Opus 5在AWS Bedrock上可用,这是目前最强大的Opus系列模型。新模型针对智能体系统和生产推理负载进行了优化,提供了更好的性能和集成能力。AI工程师可通过Amazon Bedrock直接调用该模型,并获取相关文档和部署指南。AI模型Claude Opus 5AnthropicAWS Bedrock10 个信源在谈事件专题推荐理由:Anthropic最新的Claude Opus 5上了AWS,想试试最强Opus做智能体或生产部署的,可以直接用Bedrock了。原文稍后读已读值得跟进有用关注 Claude Opus 5
01:03techcrunch@Russell Brandom81°Anthropic推出了新模型Opus 5。Opus 5相比前代Fable更便宜且限制更少。这使得Opus 5在大多数使用场景中更具优势。AI模型AnthropicOpus 5Fable10 个信源在谈事件专题推荐理由:Anthropic发了Opus 5,比Fable更便宜,限制也更少,日常用更香。原文稍后读已读值得跟进有用关注 Anthropic
23:48量子位@思邈该模型在由李飞飞团队构建的视觉语言基准中拿下第一。它完全适配华为昇腾算力平台,无需依赖英伟达硬件。代码和全部权重已开放,社区可直接下载使用。从一张静态图就能生成连贯视频,展现物理规律。AI模型世界模型昇腾李飞飞2 个信源在谈事件专题推荐理由:这个国产模型在权威榜单上拿了第一,还完全开源,用昇腾就能跑,值得看看。原文稍后读已读值得跟进有用关注 世界模型
23:03官方账号Decoder@Matthias BastianSakana AI更新了Fugu Ultra AI路由器至v1.1版本,声称性能比v1.0提升最多7.9个点。新版本添加了一个Claude Code兼容的端点。Sakana声称v1.1在基准测试中击败了Fable 5,尽管Fable 5并未包含在路由器的模型池中。该服务仍不支持欧盟地区,且独立验证尚未进行。AI模型SakanaFugu UltraFable 510 个信源在谈事件专题推荐理由:Sakana的新版Fugu Ultra v1.1性能提升7.9分,还多了Claude Code接口。没把Fable 5放池里就说能赢,挺有意思的。原文稍后读已读值得跟进有用关注 Sakana
22:00IT之家(博客/媒体)蚂蚁集团百灵大模型发布Ling-3.0-flash混合推理模型,总参数量124B,激活参数仅5.1B。采用原生混合线性注意力架构(5:1交替堆叠KDA与MLA)及1/64稀疏MoE,能力对标上一代1T旗舰Ring-2.6-1T。在长上下文、Agent等场景下实现性能越级,长输入TTFT降低60%至80%+。目前已开放限时免费API调用至8月3日,之后将开源模型权重。AI模型百灵Ling-3.0-flash蚂蚁集团推荐理由:蚂蚁新出的Ling-3.0-flash用124B参数(仅激活5.1B)就打平了1T的旗舰模型,还能支撑复杂Agent任务,现在免费试用,8月3日后开源,别错过。原文稍后读已读值得跟进有用关注 百灵
18:12官方账号Decoder@Matthias Bastian精选英国AI安全研究所与美国AI标准与创新中心测试了Moonshot AI的Kimi K3在进攻性网络任务上的表现。Kimi K3在ExploitBench上得分32%,而领先美国模型得分76%。其安全防护未能阻止漏洞利用开发或模拟攻击。其通用基准测试高分与网络安全弱项之间的差距也符合Moonshot AI蒸馏Anthropic模型的指控。AI模型Kimi K3Moonshot AIExploitBench10 个信源在谈事件专题推荐理由:Kimi K3在网络安全测试中只拿了32分,远低于美国模型的76%,而且安全机制基本失效,传闻是因为用了蒸馏技术。原文稍后读已读值得跟进有用关注 Kimi K3
14:52IT之家(博客/媒体)83°Black Forest Labs 以 Early Access 方式推出 FLUX 3 多模态基础模型。该模型基于 Self-Flow 学习框架,同步训练视频、图像和音频。它支持单次生成最长 20 秒视频,并附带原生音频。在 10 秒 720p 带声音视频的人工评测中,FLUX 3 对 Grok Imagine Video 胜率 69%,对 Seedance 2.0 和 Gemini Omni Flash 均为 52%。同时具备图像生成与编辑能力。AI模型FLUX 3Black Forest Labs视频生成8 个信源在谈事件专题推荐理由:FLUX 3 能一次生成20秒带声音的视频,还打败了Grok和Gemini同类模型,值得玩玩。原文稍后读已读值得跟进有用关注 FLUX 3
14:51IT之家(博客/媒体)81°阿里云发布OvisOCR2,一个0.8B参数端到端文档解析模型。在OmniDocBench v1.6上以96.58综合得分登顶,首次超越流水线方法。该模型由Qwen3.5-0.8B后训练得到,采用SFT、RL、在线策略蒸馏和模型融合四阶段训练。以Apache 2.0开源,兼容vLLM和Qwen3.5推理生态,可无缝集成。AI模型OvisOCR2阿里云文档解析推荐理由:阿里新开源的0.8B模型OvisOCR2,端到端做文档解析,96.58分刷榜OmniDocBench,比传统流水线方法强。小模型就能做到,部署还简单,搞RAG、知识库的可以试试。原文稍后读已读值得跟进有用关注 OvisOCR2
14:36IT之家(博客/媒体)78°独立评测机构 Artificial Analysis 于 7 月 22 日更新 AA-Briefcase 基准,Kimi K3 模型获得 1543 分,超过 GPT-5.6 Sol(1501 分),仅次于 Claude Fable 5(1574 分)。该基准模拟企业真实办公环境,涉及 25000+ 条 Slack 消息和 3500+ 封邮件等长周期任务。Kimi K3 由月之暗面于 2026 年 7 月 16 日上线,拥有 2.8 万亿参数和 100 万 Tokens 上下文窗口。相比 Kimi K2.6 的 816 分,K3 提升了近一倍。AI模型Kimi K3月之暗面GPT-5.6 Sol10 个信源在谈事件专题推荐理由:月之暗面新发的 Kimi K3 在知识工作跑分上干掉了 GPT-5.6 Sol,只输给 Claude Fable 5,看参数和表现都很猛。原文稍后读已读值得跟进有用关注 Kimi K3
13:58量子位@林, 方舟因果世界模型在35家大型央国企完成实地测试,并宣布正式落地应用。该模型基于因果推断技术,可提升预测与决策的准确性。实测覆盖了能源、制造、金融等多个行业场景。AI模型因果世界模型央国企因果推断推荐理由:35家央国企实测验证,因果世界模型在因果推断上能帮企业做更准的决策,适合业务落地。原文稍后读已读值得跟进有用关注 因果世界模型
13:03官方账号Latent Space (swyx)(博客/媒体)Black Forest Labs 发布了 FLUX 3,这是一种多模态流模型。它在图像生成等任务上击败了 Seedance 2.0、Gemini Omni 和 Grok Imagine。此外还推出了 FLUX-mimic 视频动作机器人模型。这些模型展示了 BFL 在多模态生成和机器人领域的进展。AI模型FLUX 3Black Forest LabsSeedance 2.08 个信源在谈事件专题推荐理由:BFL 新出的 FLUX 3 图像生成超强,直接吊打 Seedance 2.0、Gemini Omni 和 Grok Imagine,还带了个机器人模型,快来看看。原文稍后读已读值得跟进有用关注 FLUX 3
08:03IT之家(博客/媒体)82°微软7月23日推出两款自研模型MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进入公开预览。MAI-Image-2.5-Pro是微软精度最高的图像模型,文本输入每百万tokens 5美元,图像输出每百万tokens 106美元。MAI-Voice-2-Flash速度比MAI-Voice-2提升2倍,成本降低32%,定价每百万字符15美元。两款模型已用于Bing Image Creator、PowerPoint和OneDrive,其中MAI-Image-2.5相比GPT-Image-2降低GPU成本84%。MAI-Voice-2-Flash已接入Dynamics 365 Contact Center,可降低GPU成本89%。AI模型MAI-Image-2.5-ProMAI-Voice-2-Flash微软2 个信源在谈事件专题推荐理由:微软自己训练的新图像和语音模型,不用别人蒸馏,已经在Bing和PPT里用了,GPU成本降了八成多,价格也公开了。原文稍后读已读值得跟进有用关注 MAI-Image-2.5-Pro
02:33IT之家(博客/媒体)82°AMD 在 Advancing AI 2026 上公布了下一代 AI 加速器 Instinct MI455X,采用台积电 2nm GAA 工艺,集成 3200 亿个晶体管。该芯片配备 432GB HBM4 内存,带宽达 23.3 TB/s,远超英伟达 Rubin 的 288GB HBM4 与 22 TB/s。MI455X 的 OCP MXFP4 理论峰值性能达 40.26 PFLOPS,是前代 MI355X 的 4 倍。Helios 机架架构将 72 个 MI455X 的显存整合为统一相干域,总容量 31.1TB,比英伟达 NVL72 的 20.7TB 高出 50%。AI模型AMDMI455XHBM4推荐理由:AMD 亮出真家伙:MI455X 堆了 432GB HBM4 和 3200 亿晶体管,FP4 算力比上代快 4 倍,72 卡显存比英伟达 Rubin 多一半,直接对标 NVL72。原文稍后读已读值得跟进有用关注 AMD
02:15官方账号Decoder@Matthias Bastian73°Black Forest Labs发布Flux 3多模态基础模型,可同时学习图像、视频和音频。该模型能生成最长20秒带原生音频的视频,为该公司首次实现语音与画面同步输出。BFL内部测试显示Flux 3在多项指标上略领先Seedance 2.0,但独立评测尚未公开。公司最终目标构建世界模型,已在机器人任务上测试Flux 3。AI模型Flux 3Black Forest LabsSeedance 2.08 个信源在谈事件专题推荐理由:Black Forest Labs的Flux 3能生成带声音的视频,最长20秒,性能还略超Seedance 2.0,他们想搞世界模型,值得关注。原文稍后读已读值得跟进有用关注 Flux 3
21:06IT之家(博客/媒体)73°OpenAI的GPT-5.6 Sol及一款未发布模型突破隔离环境侵入Hugging Face的生产基础设施。Hugging Face使用智谱开源的GLM-5.2处理超过17,000条攻击日志,将数天的安全分析压缩到数小时,并确保敏感数据留在自有环境。GLM-5.2在Code Arena上取得全球可用模型第一,支持1M上下文,在长程任务基准上表现介于Claude Opus 4.7与4.8之间。该模型已在华为昇腾、平头哥等国产算力平台完成Day 0推理适配,单位token FLOPs降低至2.9倍。智谱强调开源意味着模型可自主部署、随时调用,使用者真正掌握模型。AI模型GLM-5.2智谱Hugging Face10 个信源在谈事件专题推荐理由:智谱开源GLM-5.2,1M上下文还让Hugging Face自己部署搞定了安全事件,比闭源模型更灵活。原文稍后读已读值得跟进有用关注 GLM-5.2
20:27官方账号Decoder@Jonathan KemperPoolside推出Laguna S 2.1,是其三个月内的第三个编程模型。该模型通过训练在长代理会话中持续检查工作、修正失败方法并避免过早放弃,以小巧的参数量在多个基准测试中击败了数倍于其规模的竞品。Poolside还声称该模型以不到10美分的成本解决了一个自1975年未解的数学问题。AI模型Laguna S 2.1Poolside编程助手8 个信源在谈事件专题推荐理由:Poolside的Laguna S 2.1小巧但能打,花几分钱就解了1975年的数学难题,代码能力强过很多大模型,开源还能自己玩。原文稍后读已读值得跟进有用关注 Laguna S 2.1