VOL.2026.07.20·73 STORIES·AITOP DAILY

AITOP日报

二〇二六年七月二十日 星期一DAILY · 每早八时
01

模型发布/更新

Model Releases
5

OpenMOSS 发布 MOSS-Transcribe-Diarize-0.9B,端到端多人长音频转写模型

X·KOLX:宝玉 (@dotey)原文 ↗

OpenMOSS 开源了 MOSS-Transcribe-Diarize-0.9B 模型,参数规模 0.9B,支持 128K 上下文,最长可一次处理约 90 分钟音频。该模型采用 Whisper-Medium 编码器 + Qwen3-0.6B 风格 decoder,端到端完成转写、说话人分离和时间对齐,无需级联流程。在单张 4090 显卡上,RTF 为 0.017,5-10 分钟录音约 30 秒转完,并支持热词增强。模型以 Apache 2.0 协议开源,可商用。

面壁智能发布端侧模型 MiniCPM5-2B,AA-Index 4B以下全球性能第一

官方IT之家原文 ↗

面壁智能联合OpenBMB发布端侧模型MiniCPM5-2B,在Artificial Analysis(AA)榜单中以17分取得全球4B以下模型最高分。该模型原生支持混合思考,提供512K超长上下文窗口,可处理整本长篇小说或数十万行代码。训练阶段执行了200B规模的Agent Midtraining和百万条轨迹的Agent SFT,具备工具调用、深度搜索等智能体能力。目前已适配AMD、英特尔、联发科、高通等全球主流芯片,覆盖华为昇腾、英伟达等9款芯片。模型即将在Hugging Face、魔搭等平台开源。

月之暗面 Kimi K3 大模型登顶全球榜单,彭博社称美领先优势被打破

官方IT之家原文 ↗

月之暗面于7月19日发布Kimi K3大模型,拥有2.8万亿参数和100万Tokens上下文。该模型在Frontend Code Arena榜单中以1679分超越Claude Fable 5,排名第一。彭博社报道称,这一成绩打破了美国AI领先中国的固有认知。伯克利教授斯托伊卡表示,差距已从6-9个月缩小到2-3个月。市场质疑硅谷数千亿美元投资的回报,企业用户开始通过模型路由服务选用中国模型。

02

产品发布/更新

Product
5

阿里云百炼发布 HappyOyster 1.0,一句话生成可互动AI数字世界

官方IT之家原文 ↗

阿里云百炼于7月19日上线世界模型产品HappyOyster 1.0。该模型从海量视频中学习物理规律,用户输入一句话或一张图即可生成可交互数字世界。提供世界探索和实时导演两种模式,分别支持1分钟连续交互和3分钟以上分支叙事。已开放Android/iOS/Web三端SDK,在阿里云百炼开启灰测。可用于游戏原型、互动短剧、虚拟陪伴等场景。

蚂蚁数科发布商业智能体平台Agentar2.0,预置200个岗位数字专家模板

官方IT之家原文 ↗

7月19日,蚂蚁数科在世界人工智能大会发布Agentar2.0,首批预置200个岗位级数字专家模板和数百个Skills级工具。平台基于自研LingDT模型提升Token效率,搭配Agentix操作系统实现全流程调度。通过区块链技术为每个Agent赋予可信身份,促进多智能体协同。目前已在金融行业落地超300个智能体,并向能源、出行等领域拓展。

燧原科技联合中兴通讯发布云燧 ESL64-O 超节点,自研 AI 芯片与架构创新降低互联成本

官方IT之家原文 ↗

燧原科技与中兴通讯在 2026 世界人工智能大会上发布云燧 ESL64-O 超节点,采用自研 AI 芯片和 OEX 正交无背板设计,实现 0 线缆互联,大幅降低互联成本。燧原还联合先封科技推出适配 AI 算力芯片的 CoPoS 面板级先进封装样品,具备热膨胀系数可调、高频信号损耗极低等优势。该公司已获科创板上市注册批复,拟募集 60 亿元用于第五代和第六代 AI 芯片研发。

03

行业动态

Industry
5

AI手机竞争不在模型而在用户入口,超级应用是关键

官方一手X·KOLX:Pandaily (@contact@pandaily.com (Pandaily))原文 ↗

WAIC 2026达成的行业共识显示,AI手机的核心竞争已从模型能力转向智能体OS入口点,包括系统级权限控制和服务分发渠道。手机厂商正试图通过深度系统集成(如调用摄像头、短信、位置等底层权限)来建立壁垒,而超级应用(如微信、支付宝)原本掌握的用户入口正被剥离。这场博弈将决定未来3年手机行业话语权归属,目前华为、小米、OPPO等均展示了各自的智能体框架方案。

Dean Ball谈Moonshot Kimi:开源模型的经济与政治

X·KOLX:@koltregaskes (@koltregaskes)原文 ↗

Dean Ball认为Moonshot的Kimi模型在agentic coding上表现不错,大致匹配2026年Q1的最佳模型,但测试发现其token消耗大,成本优势不如预期。他拆分中国开源动因:75%源于对AGI风险的战略盲目,25%出于实际需要——中国实验室无法在付费服务上竞争,且境外不愿付费。他的核心观点是免费模型削弱前沿实验室收入,减缓顶级模型进度,可能推动AI走向类似国家基础设施的“AI共产主义”乌托邦地狱。他还指出监管已通过Gold Eagle和Mythos断块制造不确定性,迫使公司回避中国模型,并认为开源模型的国家安全担忧已接近不可忽视。

千里科技在WAIC公布多项进展:阶跃Step AOS将应用于汽车,年底推ASD 5.0

官方IT之家原文 ↗

在WAIC 2026期间,千里科技公布ASD 4.1技术预览,实现零断点全场景D2D通行。ASD 4.1基于物理AI大模型,提升对小动物、特殊车辆等识别能力。千里科技计划年底推出ASD 5.0版本。阶跃星辰发布智能体原生操作系统Step AOS,千里科技将其应用于汽车领域。搭载在极氪8X上的超级智能体“超级Eva”已上线,支持模糊出行需求自动导航和本地生活服务调用。

全国首个具身智能实训场样板点发布

官方IT之家原文 ↗

国地共建人形机器人创新中心与华为联合发布全国首个具身智能实训场样板点。该实训场打通了不同品牌人形机器人的训练数据接口,支持工业搬运、巡检、服务类等多种机型。实训场可完成高温、雨天、狭小通道等复杂场景的仿真训练,并对外开放中小机器人企业试用名额。样板点搭载了具身智能VLA大模型,基于国产算力底座,性能指标处于行业前列。

04

论文研究

Research
3

Google Deepmind 用视频生成器完成视觉任务,性能媲美专用模型

官方账号X·KOLX:Decoder (@Jonathan Kemper)原文 ↗

Google Deepmind 提出 GenCeption 方法,利用视频生成器完成深度估计和语义分割等经典视觉任务。该方法在仅使用合成视频训练的情况下,匹配甚至超越当前最先进系统的性能。研究团队认为视频生成器内部已经隐式包含了一种通用世界模型,这挑战了传统计算机视觉的范式。GenCeption 在 KITTI 深度估计基准上取得了与基于真实数据训练的模型相当的结果,证明了其有效性。

开源模型Kimi K3登顶Arena前端代码榜,超越Claude Fable 5和GPT-5.6 Sol

X·KOLX:@koltregaskes (@koltregaskes)原文 ↗

Kimi K3在Arena's Frontend Code盲测中击败Claude Fable 5和GPT-5.6 Sol,排名第一。在DeepSWE基准上,K3得69%且每任务成本$4.65,而Sol得73%成本$8.39,Fable 5得70%成本$21.63。在Artificial Analysis的Intelligence Index上,K3得57分,仅比Fable 5的60分低3分。该模型在长时编码和知识工作方面表现突出,在AA-Briefcase排名第二。但幻觉率为51%,接近Grok 4.5的54%。开放权重将于7月27日发布。

05

技巧与观点

Tips & Takes
3
73
今日事件
45
一手报道
28
新模型
26
信源
AITOP · 编辑系统自动生成