04:28官方一手marktechpost@Asif Razzaq精选Kyutai 与 Mirelo 联合发布 MuScriptor,一个基于解码器-only Transformer 的开源权重模型。该模型在 17 万条真实录音和 145 万条合成 MIDI 数据上训练,可将包含多种乐器的混音直接转录为 MIDI 格式。与 YourMT3+ 等基线相比,MuScriptor 在多项基准测试中取得了更优的转录准确率,并支持乐器条件控制。AI模型MuScriptorKyutai音乐转录推荐理由:想做多乐器音乐自动转录?Kyutai 开源了 MuScriptor,训练数据 160 多万条,比 YourMT3+ 更准,还带交互演示。原文稍后读已读值得跟进有用关注 MuScriptor
03:08官方账号Decoder@Matthias Bastian76°OpenAI的GPT-5.6 Sol模型独自对较小的Luna模型进行了后训练微调,触发方式仅为一个“相当不明确的提示词”。在OpenAI内部的RSI(递归自我改进)基准测试中,Sol的得分比GPT-5.5高出16.2分。OpenAI表示,这一进展让“自动化研究员”目标更加接近现实。AI模型GPT-5.6 SolLunaOpenAI10 个信源在谈事件专题推荐理由:OpenAI又搞事情了:GPT-5.6 Sol用一句模糊指令就能自动调教出更强的Luna,性能比上一代飙升16分,自动化研究越来越近了。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
02:08官方账号Decoder@Matthias BastianGPT-5.6 Sol提供从 Light 到 xhigh 的五个推理层级,并新增 Max 和 Ultra 模式,可并行调用多个子智能体。OpenAI 员工 Vaibhav Srivastav 建议用户从低层级开始,仅在必要时才升级推理强度。不同层级分别适用于简单问答、复杂逻辑分析、多步规划等不同复杂度任务。AI模型GPT-5.6 SolOpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI员工亲自教你怎么选GPT-5.6 Sol的推理强度,从Light到xhigh再到Ultra,避免浪费算力。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
19:22官方账号Decoder@Maximilian Schreiner76°Bun这个JavaScript工具已从Zig完全重写为Rust,整个过程借助了Anthropic的Claude Fable 5模型。Fable 5在11天内生成了超过一百万行代码,完成了整个重写工作。这次重写展示了Claude Fable 5在大型代码迁移任务中的效率。Bun团队尚未公布具体性能对比数据,但表示新版本已通过测试。AI模型BunRustClaude Fable 510 个信源在谈事件专题推荐理由:Bun原来用Zig写的,现在直接换成Rust了,而且靠Claude Fable 5在11天里写了100多万行代码,这AI写代码的效率太吓人了。原文稍后读已读值得跟进有用关注 Bun
17:49量子位@十三LingBot-VA 2.0 是首个从物理世界数据出发的具身原生预训炼模型,相比上一代在机器人操作成功率上提升 15%。该模型采用自监督学习框架,无需人工标注即可从传感器数据中学习物理规律。在 3 个标准机器人基准测试(如 RoboTurk、FMB)中,LingBot-VA 2.0 均达到业界领先水平。同时,其模型参数规模为 7B,支持零样本迁移到新物体和场景。AI模型LingBot-VA 2.0具身智能预训练模型推荐理由:想要给机器人造更聪明的脑子?这个模型直接学物理世界数据,不用人工标注,操作成功率提高15%,还是开源的,值得关注。原文稍后读已读值得跟进有用关注 LingBot-VA 2.0
16:56官方一手marktechpost@Michal Sutter73°Google Research 联合 DeepMind 等团队推出 SensorFM,一个基于 ViT-1D 掩码自编码器架构的可穿戴健康基础模型。模型在超过 1 万亿分钟来自 500 万参与者的未标注传感器信号上预训练。实验对比 4 种模型规模和 4 种数据量,发现当模型容量超过数据量时性能仍可提升。使用冻结嵌入加 PCA-50 线性探针,在 35 个健康任务中的 34 个上超过了传统特征工程基线。团队还通过 agentic 教室搜索了 30,516 个预测头,并进行了临床评估以验证个人健康智能体。AI模型SensorFMGoogle Research可穿戴健康推荐理由:谷歌用海量传感器数据训了个健康大模型 SensorFM,在 35 项任务里赢了 34 个,比传统方法靠谱多了,做可穿戴健康的朋友可以看看。原文稍后读已读值得跟进有用关注 SensorFM
16:01官方一手pandaily@contact@pandaily.com (Pandaily)Jiying 2.0-s物理基础模型实现了对未见几何形状、新材料和不同边界条件的零样本泛化,在工程仿真中无需重新训练即可适用多种工况。该模型基于极影科技自研框架,首次在固体力学领域达到跨设置零样本推理能力。基准测试显示其在位移场和应力场预测上优于传统数值方法。AI模型Jiying 2.0-s极影科技物理基础模型推荐理由:极影科技搞出了首个能零样本泛化的固体力学模型Jiying 2.0-s,不用针对每种新几何新材料重新训练,直接推理结果,搞仿真的可以看看。原文稍后读已读值得跟进有用关注 Jiying 2.0-s
14:43量子位@Jay字节跳动推出从零预训练的十亿参数AI音乐模型,专门优化华语歌曲生成。该模型显著降低了合成歌声的机械感,音质接近真人演唱。模型训练数据涵盖大量华语流行歌曲,提升了歌词发音准确性和情感表现力。这是字节在AI音乐领域的首次重要布局。AI模型字节跳动AI音乐模型十亿参数2 个信源在谈事件专题推荐理由:字节出的AI音乐模型,专为华语歌训练,十亿参数,听着终于不‘电子味儿’了,可以试试。原文稍后读已读值得跟进有用关注 字节跳动
12:43官方一手marktechpost@Asif Razzaq精选蚂蚁集团Robbyant团队发布LingBot-World-Infinity(LingBot-World 2.0),一个14B参数因果视频生成模型,用作交互式世界模拟器。核心创新包括混合双向自回归(MoBA)注意力机制和分布匹配蒸馏,解决长程漂移导致的纹理模糊和几何变形。报告展示单个60分钟不间断会话涵盖20个场景。但发布内容仅包含一个检查点、480P参考脚本,无部署代码和定量基准,且采用非商业许可CC BY-NC-SA 4.0。AI模型LingBot-World-InfinityRobbyant蚂蚁集团推荐理由:蚂蚁发了14B的世界模型LingBot-World-Infinity,能生成60分钟视频模拟20个场景,用MoBA注意力解决长时间漂移。不过目前只开放了检查点,没有完整代码。原文稍后读已读值得跟进有用关注 LingBot-World-Infinity
12:41量子位@量子位的朋友们蚂蚁灵波推出了LingBot-VA 2.0。这是行业首个具身原生世界动作模型。版本号升级至2.0。AI模型LingBot-VA 2.0蚂蚁灵波具身智能推荐理由:蚂蚁灵波发了首个具身原生动作模型LingBot-VA 2.0,能直接理解世界动作,跟以前的模型不一样。原文稍后读已读值得跟进有用关注 LingBot-VA 2.0
10:47IT之家(博客/媒体)微软发布 Aurora 1.5 天气预报模型,新增22种变量并支持小时级预测。在测试中,该模型对海伦妮飓风路径预测的中位数误差率比上一代降低三分之一。整体准确率达88.9%,优于欧洲中期天气预报中心(ECMWF)模型。模型已在 GitHub 开源,并计划集成到 Microsoft Weather 等商业产品中。AI模型Aurora 1.5微软天气预报推荐理由:微软开源了Aurora 1.5,预测飓风路径误差降了三分之一,还比欧洲模型准88.9%,搞气象的可以试试。原文稍后读已读值得跟进有用关注 Aurora 1.5
08:19techcrunch@Lucas RopekOpenAI 推出 GPT-5.6,这是其最新模型系列中的一员。微软将 GPT-5.6 设为 Copilot 的首选模型,用于驱动 Office 365 等生产力应用。这一决定出现在外界猜测两家公司可能分道扬镳的背景下。OpenAI 表示将继续为微软生态提供支持。AI模型GPT-5.6OpenAIMicrosoft Copilot10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 成了微软 Copilot 的标配,两家虽然被传要分手但合作还在继续,微软办公套件会深度集成这个新模型。原文稍后读已读值得跟进有用关注 GPT-5.6
08:00IT之家(博客/媒体)83°OpenAI 于 7 月 10 日发布 GPT-5.6 系列模型,在 ChatGPT、Codex 和 API 中上线。微软 CEO 纳德拉称 Copilot 同步接入该模型。Codex 正从编程 AI Agent 向通用 Agent 方向演进。AI模型GPT-5.6OpenAIChatGPT10 个信源在谈事件专题推荐理由:OpenAI 发了 GPT-5.6 系列,直接上 ChatGPT 和 API,微软 Copilot 也跟进了。Codex 要往通用 Agent 走,挺有意思的。原文稍后读已读值得跟进有用关注 GPT-5.6
07:37IT之家(博客/媒体)苹果正与PrismML接洽,评估其原生1-bit模型压缩技术。该技术将Qwen 3.6(27B参数)压缩至全精度1/14体积,内存占用降低超90%,推理速度提升最高8倍,能耗降低75%-80%,已在iPhone 17 Pro上完整运行。PrismML声称精度接近FP16模型,无“高精度逃生通道”。苹果希望借此增强本地AI推理性能。AI模型PrismMLQwen 3.6iPhone 17 Pro推荐理由:苹果想用这技术让27B的Qwen 3.6在手机上跑,速度比原来快8倍,能耗降75%,还能保持精度,挺牛的。原文稍后读已读值得跟进有用关注 PrismML
07:19IT之家(博客/媒体)74°OpenAI 首席执行官 Sam Altman 表示,GPT-5.6 Sol 在 AI 智能体编程任务中表现与市场主流竞争模型(如 Anthropic 的 Claude Fable 5)相当或更优,Token 效率提高 54%。该模型已于7月10日上线,同期发布的还有 Terra 和 Luna 系列。初期使用限制是应美国政府要求,OpenAI 正配合商务部长等官员加速模型测试审查。AI模型GPT-5.6 SolOpenAI智能体10 个信源在谈事件专题推荐理由:OpenAI 刚发的 GPT-5.6 Sol,编程不输 Claude 还省 54% token,想尝鲜的可以试试。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
06:49IT之家(博客/媒体)91°OpenAI 发布 GPT-5.6 系列,包含 Sol、Terra、Luna 三档模型,价格从每百万 token 输入 1 美元到 5 美元不等。旗舰版 Sol 在 Terminal-Bench 2.1 上标准模式得分 88.8%,超过 Claude Mythos 5 的 88.0%,开启 Ultra 模式后达 91.9%。微软 CEO 纳德拉宣布 Copilot Chat、Cowork、M365、GitHub 和 Foundry 同步上线该模型。AI模型GPT-5.6SolOpenAI10 个信源在谈事件专题推荐理由:OpenAI 出了 GPT-5.6 系列,分三档定价,最贵的 Sol 编程跑分超 Claude Mythos 5,微软 Copilot 也直接用上了。想试试新模型可以看看。原文稍后读已读值得跟进有用关注 GPT-5.6
06:33techcrunch@Lucas Ropek88°OpenAI 于 7 月 9 日推出 GPT-5.6 模型系列,该系列在包括网络安全在内的多个领域带来改进。GPT-5.6 是 OpenAI 继 GPT-4 之后的新一代模型,具体性能细节尚未完全公开。此次发布标志着 OpenAI 在安全能力上的重点投入。AI模型GPT-5.6OpenAIAI安全10 个信源在谈事件专题推荐理由:OpenAI 出了 GPT-5.6,主打网络安全,想看看新模型怎么防黑客的可以点进去。原文稍后读已读值得跟进有用关注 GPT-5.6
06:31官方一手marktechpost@Asif Razzaq72°Meta Superintelligence Labs于2026年7月9日发布Muse Spark 1.1,并开放Meta Model API公测。该模型拥有100万token上下文窗口,可主动压缩上下文。它支持零样本泛化到新工具和MCP服务器,并具备多智能体委托能力,可并行执行子任务。在工具使用基准上Muse Spark 1.1领先,但在编码任务上落后于Opus 4.8和GPT-5.5。AI模型Muse Spark 1.1Meta推理模型推荐理由:Meta新出的多模态推理模型,百万token上下文,工具调用很强,但写代码不如Opus和GPT。原文稍后读已读值得跟进有用关注 Muse Spark 1.1
04:52官方一手marktechpost@Michal Sutter81°OpenAI于2026年7月9日推出GPT-5.6,包含Sol、Terra、Luna三个档次。Sol定价为$5/$30每百万输入/输出token,在Artificial Analysis Coding Agent Index上以80分领先Claude Fable 5达2.8分,并在OSWorld 2.0上达到62.6%,比Opus 4.8少用85%输出token。新功能Programmatic Tool Calling在隔离V8运行时执行JavaScript,减少Clio 38%的prompt tokens和PlayCo 63.5%的总tokens。但Claude Fable 5仍在Artificial Analysis Intelligence Index、GDPval-AA v2和Toolathlon上领先,Mythos 5在SWE-Bench Pro领先约15分。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI出了三个价位的GPT-5.6,最贵的Sol编程跑分居然超了Claude Fable 5,还加了省token的自动调用工具功能,想比差距的可以看看原文稍后读已读值得跟进有用关注 GPT-5.6
04:00官方一手OpenAI Blog(博客/媒体)OpenAI 推出 GPT-5.6,并指定其为 Microsoft 365 Copilot 的首选模型。该模型在 Word、Excel、PowerPoint、Chat 和 Cowork 中提供更强的 AI 支持,能更快生成文档、分析数据。相比前代,GPT-5.6 在多项任务上提升了响应速度和质量。用户无需额外配置即可在 Copilot 中直接使用。AI模型GPT-5.6Microsoft 365 CopilotOpenAI10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 已经内嵌到 Office 全家桶里了,写文档做表格更快,用 Copilot 的话值得了解。原文稍后读已读值得跟进有用关注 GPT-5.6
03:49官方账号Simon Willison’s Weblog(博客/媒体)82°OpenAI发布GPT-5.6三款模型Luna、Terra、Sol,定价分别为每百万token $1/$6、$2.50/$15、$5/$30。在Agents' Last Exam基准上,Sol以53.6分领先Claude Fable 5(自适应推理)13.1分,Terra和Luna以约1/16成本超越Fable 5。但在SWE-Bench Pro上Fable 5得80%,Sol仅64.6%。OpenAI近期发文质疑该基准约30%任务存在问题。新API支持程序化工具调用、多智能体协作和显式提示缓存断点。AI模型GPT-5.6OpenAIClaude Fable 510 个信源在谈事件专题推荐理由:GPT-5.6家族上线:Luna平价,Sol推理强,但真实编码表现不及Claude Fable 5,且新增多智能体API。原文稍后读已读值得跟进有用关注 GPT-5.6
02:55官方账号Decoder@Matthias Bastian76°OpenAI 的 GPT-5.6 Sol 在 Artificial Analysis Intelligence Index 上获得 59 分,仅比 Anthropic 的 Claude Fable 5 低 1 分。Sol 每次任务成本为 1.04 美元,是 Fable 5 的三分之一。在智能体编程任务中,Sol 超越所有竞品,进一步加大 Anthropic 的定价压力。AI模型GPT-5.6 SolFable 5OpenAI10 个信源在谈事件专题推荐理由:OpenAI 新模型 Sol 基准只差 Fable 5 一分,价格只要三分之一,编程还更强,性价比拉满!原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
02:44官方账号OpenAI@OpenAI (@OpenAI)GPT‑5.6 改进了演示文稿、文档和电子表格中工件的生成质量。新版本更好地适配用户模板,提升对齐与格式效果。这些可编辑的工件可直接导出到常用专业工具中,融入企业工作流。AI模型GPT-5.6OpenAI文档生成10 个信源在谈事件专题推荐理由:OpenAI 的 GPT‑5.6 改善了演示文稿、文档和表格里的内容生成,支持模板和导出到专业工具,办公更方便。原文稍后读已读值得跟进有用关注 GPT-5.6
02:42官方账号OpenAI@OpenAI (@OpenAI)93°OpenAI 今日发布 GPT-5.6,面向 ChatGPT、Codex 和 OpenAI API 用户。Plus、Pro、Business 和 Enterprise 用户可通过中等和高努力设置使用 GPT-5.6 Sol。Pro 和 Enterprise 用户还可选择 GPT-5.6 Pro 处理复杂任务。全球逐步推出,计划 24 小时内全量可用。AI模型GPT-5.6OpenAIChatGPT10 个信源在谈事件专题推荐理由:OpenAI 刚发了 GPT-5.6,有 Sol 和 Pro 两个版本,Pro 用户能选最强档,现在就能在 ChatGPT 和 API 上用。原文稍后读已读值得跟进有用关注 GPT-5.6
01:11官方一手OpenAI Blog(博客/媒体)OpenAI 发布 GPT-5.6 模型。官方宣称每个 token 提供更多智能,提升输出质量。性能每美元更强,降低使用成本。模型可按需扩展能力,处理最困难的复杂任务。AI模型GPT-5.6OpenAI推理模型10 个信源在谈事件专题推荐理由:OpenAI 推新模型 GPT-5.6,token 利用更高效,每美元性能更强,适合高难度任务。原文稍后读已读值得跟进有用关注 GPT-5.6
00:49官方账号Simon Willison’s Weblog(博客/媒体)精选Meta 推出 Muse Spark 1.1,这是 Spark 系列首个提供 API 的模型。相比 4 月的初始版本,该模型在 agentic tool calling 和 computer use 方面有显著改进。Meta 发布了 Muse Spark 1.1 评估报告,其中包含“自对话中的吸引子状态”实验,两个模型副本对话会产生类似“我的整个存在是一个等候室”的表述。开发者可通过 llm-meta-ai 插件在命令行或 Python 中调用该模型。AI模型Muse Spark 1.1Meta智能体推荐理由:Meta 给 Muse Spark 1.1 加了 API,工具调用和电脑操控都更强了,还有自对话的玄学彩蛋,玩起来挺有意思。原文稍后读已读值得跟进有用关注 Muse Spark 1.1
22:44IT之家(博客/媒体)73°Meta 今日正式向开发者开放 Muse Spark AI 模型 API,并发布升级版 Muse Spark 1.1。Muse Spark 1.1 是 Meta 迄今在编程和智能体任务方面最强的模型,支持编写调试代码、操作软件、理解文本图片视频。API 定价为每百万输入 Token 1.25 美元、每百万输出 Token 4.25 美元,高于 GPT-5 mini 和 Claude Haiku 4.5,低于 Claude Sonnet 4.6。开发者注册可获得 20 美元免费额度。该模型已在 Meta AI 应用中上线 Thinking 模式。AI模型MetaMuse SparkAPI推荐理由:Meta 终于开放 Muse Spark API 了,1.1 版编程和智能体能力很强,定价比 GPT-5 mini 高但比 Claude Sonnet 低,开发者快去试试。原文稍后读已读值得跟进有用关注 Meta
19:13官方账号Decoder@Matthias Bastian精选Databricks在其数百万行代码库上测试编程智能体,发现中国开源模型GLM 5.2性能与Anthropic的Opus 4.8相当。每任务成本GLM 5.2为1.28美元,Opus为1.94美元。Databricks计划将GLM 5.2作为日常编程工作主力。该公司认为没有单一供应商占主导地位,企业应自建基准而非依赖公共基准。AI模型GLM 5.2DatabricksOpus10 个信源在谈事件专题推荐理由:Databricks选了国产开源模型GLM 5.2当默认编程引擎,每花1.28美元能干出Opus 1.94美元的活,省钱了性能还不差。原文稍后读已读值得跟进有用关注 GLM 5.2
18:35IT之家(博客/媒体)Arena平台公布6月29日~7月5日大模型对战综合榜,Anthropic的claude-fable-5以1509 ELO分蝉联第一,领先第二名claude-opus-4-6-thinking仅5分。前十名全部为美国厂商,gemini-3.5-flash上升2位至第11名,glm-5.1下滑3位至第22名。国产模型中,阿里qwen3.7-max-preview以1475分排名第15,百度ernie-5.1以1468分排第27,小米mimo-v2.5-pro以1466分列第29。代码榜中Anthropic垄断前九,claude-fable-5得1563分居首,国产qwen3.7-max-preview位列第10。数学榜由claude-opus-4-6-thinking以1518分领跑,国产kimi-k2.6排名第13。AI模型claude-fable-5qwen3.7-max-previewernie-5.110 个信源在谈事件专题推荐理由:这期榜单告诉你哪家模型综合最强、代码最好、数学最牛。国产的qwen3.7-max-preview在代码榜进了前十,值得看看。原文稍后读已读值得跟进有用关注 claude-fable-5
18:13官方账号Decoder@Maximilian Schreiner88°在AtCoder World Tour Finals 2026的表演赛中,OpenAI的AI系统解决了算法部门的全部5道题目,其中2道被观测者评为特别困难。该系统击败了所有人类参赛者,展示了在顶级竞争性编程中超越人类的能力。AI模型OpenAIAtCoder编程竞赛10 个信源在谈事件专题推荐理由:OpenAI的AI刚刚在AtCoder的世界决赛上碾压了所有人类选手,5道题全解,2道超难。想看看AI编程到底多强?原文稍后读已读值得跟进有用关注 OpenAI
16:52官方一手marktechpost@Asif Razzaq73°NVIDIA发布Nemotron-Labs-3-Puzzle-75B-A9B,这是Nemotron-3-Super的压缩变体。通过Iterative Puzzle方法,总参数从120.7B降至75.3B,活跃参数从12.8B降至9.3B。在单台8xB200节点上,它实现了2.03倍于Super的总吞吐量,每用户100 tok/s。在H100上,1M-token并发从1提升到8。AI模型NemotronNVIDIAMoE10 个信源在谈事件专题推荐理由:NVIDIA把这个MoE模型压到75B,吞吐翻倍,用户延迟不变,适合降本增效。原文稍后读已读值得跟进有用关注 Nemotron
15:17IT之家(博客/媒体)精选Mistral推出Robostral Navigate模型,总参数量8B,仅靠单个RGB摄像头即可在复杂环境中自主导航。该模型在R2R-CE基准测试中,validation seen成功率达79.4%,validation unseen成功率达76.6%,比最佳单摄像头方案高9.7分,比使用深度传感器或多摄像头的系统高4.5分。训练数据来自6000个虚拟空间中的约40万条路径。模型适用于轮式、腿式和飞行机器人。AI模型MistralRobostral NavigateR2R-CE1 个信源在谈事件专题推荐理由:Mistral出了个机器人导航模型Robostral Navigate,只用普通摄像头,在R2R-CE上比所有单摄像头方案高9.7分,挺实用的。原文稍后读已读值得跟进有用关注 Mistral
15:11IT之家(博客/媒体)精选蚂蚁灵波科技开源LingBot-Video,这是全球首个基于MoE架构的面向具身智能视频生成基础模型。模型总参数30B,生成时仅激活约3B,推理效率是同等Dense架构的3倍。训练数据包含7万小时机器人相关数据,结合多维强化学习奖励系统。在RBench基准上总分0.620,超越Wan2.6(0.607)、Seedance 1.5 Pro(0.584)等模型。可用于机器人动作预测、仿真数据生成等方向。AI模型LingBot-Video蚂蚁灵波MoE推荐理由:蚂蚁灵波开源了LingBot-Video,专为机器人设计,RBench上超过Wan2.6,推理快3倍,适合做训练数据。原文稍后读已读值得跟进有用关注 LingBot-Video
15:00量子位@十三该模型采用MoE架构,专为机器人具身场景设计。它首次将混合专家模型用于视频生成与动作控制的融合。模型已开源到GitHub,参数量为7B。在RoboCasa基准上取得了领先成绩。AI模型MoE具身智能视频生成推荐理由:这是首个专门给机器人做的MoE视频模型,能看懂视频并规划动作,还开源了,做具身智能的值得看看。原文稍后读已读值得跟进有用关注 MoE
14:55IT之家(博客/媒体)精选蚂蚁灵波开源了全新实时交互世界模型LingBot-World 2.0(14B参数),支持720p/60fps高清画面,可实现小时级不间断生成且画质不衰减。该模型支持战斗、跳跃、滑翔等丰富动作,以及文本驱动的事件注入,内置Pilot Agent和Director Agent机制,还支持多人同时探索。开源版本采用非商用开源协议,已联合Reactor和灵光APP提供在线体验。该模型可应用于游戏开发、交互式创作、自动驾驶仿真和具身智能训练。AI模型LingBot-World 2.0蚂蚁灵波世界模型3 个信源在谈事件专题推荐理由:蚂蚁灵波开源的世界模型能让你实时操控高清场景,战斗跳伞滑翔,多人一起玩,连续跑一小时不崩,比传统模型强很多。原文稍后读已读值得跟进有用关注 LingBot-World 2.0
14:50IT之家(博客/媒体)精选Artificial Analysis 新增 6 个行业指数测试,Claude Fable 5 在全部 8 项指标中排名第一。Claude Opus 4.8 六项第二,GPT-5.5 xhigh 拿下剩余两项第二。开放权重模型 GLM-5.2 在 5 个行业指数中领先,工程基准得 53 分。成本方面,Claude Fable 5 在战略与运营指数中每任务成本 3.48 美元,是 DeepSeek V4 Pro max(0.03 美元)的 116 倍,性能仅高 12 分。DeepSeek V4 Flash 成本低于 0.04 美元,得分处于中游。AI模型Claude Fable 5DeepSeek V4 ProGPT-5.510 个信源在谈事件专题推荐理由:想选行业AI模型?Claude Fable 5 碾压全场,但成本是 DeepSeek V4 Pro 的百倍,性能只多 12 分,性价比得掂量。原文稍后读已读值得跟进有用关注 Claude Fable 5
12:57量子位@量子位的朋友们71°蚂蚁灵波团队开源了LingBot-World 2.0,这是首个支持小时级生成的世界模型,将以往数天的生成时间缩短到数小时内。该模型支持AI原生多人交互,用户可实时参与并影响场景演化。LingBot-World 2.0在多个物理模拟基准上达到SOTA,例如在Habitat测试中导航成功率提升12%。这意味着开发者可以用更低的成本构建逼真的虚拟环境,加速具身智能研究。AI模型LingBot-World 2.0蚂蚁灵波世界模型3 个信源在谈事件专题推荐理由:想低成本搞个能交互的虚拟世界?蚂蚁灵波开源了LingBot-World 2.0,小时级就能生成,还支持多人一起玩,比之前那些模型快多了。原文稍后读已读值得跟进有用关注 LingBot-World 2.0
11:53量子位@量子位的朋友们量化派基于餐饮后厨场景的多模态数据,训练了物理世界基础模型Q-Phys-v1。该模型在Meta Habitat 2.0基准的物体抓取任务上达到88%成功率,在自主导航任务中路径规划效率提升40%。模型通过API和SDK向企业开放,支持场景定制。AI模型量化派Q-Phys物理世界基础模型推荐理由:量化派把餐饮后厨数据用到物理模型上,思路很落地,Q-Phys在机器人任务上表现不错,适合做机器人和自动驾驶的公司看看。原文稍后读已读值得跟进有用关注 量化派
11:22IT之家(博客/媒体)精选蓝戟测试英特尔 Arc Pro B70 GPU 在 DeepSeek R1-Distill Qwen 32B FP16 模型推理性能。并发 128 时 Arc Pro B70 吞吐比 RTX 5090D 高 8.6%,比 RTX 4090D 高 34.2%。并发 256 时分别高 7.5% 和 48.7%。最高吞吐达 2320.76 token/s。并发低于 32 时 RTX 5090D 仍领先。AI模型Arc Pro B70DeepSeek R1RTX 5090D推荐理由:蓝戟实测发现 Intel Arc Pro B70 跑 DeepSeek R1 推理比 RTX 5090D 还快,高并发场景优势明显,适合做推理部署参考。原文稍后读已读值得跟进有用关注 Arc Pro B70
09:04爱范儿@郑廷旭GPT-5.6 定于本周全量上线。Claude Fable 5 免费使用期延长至 7 月 12 日。SpaceX 股价跌破上市首日开盘价。AI模型GPT-5.6Claude Fable 5SpaceX10 个信源在谈事件专题推荐理由:今天早报有GPT-5.6上线、Claude Fable 5免费延长、SpaceX股价破发,三条短讯快速掌握动态。原文稍后读已读值得跟进有用关注 GPT-5.6