8月7日
11:57
03:44
01:06
01:06官方一手OpenAI Blog博客/媒体
OpenAI在ChatGPT中推出改进后的GPT-5.6 Sol,提升了准确性和一致性。免费用户现在可以访问该模型,并享受与GPT-5.6 Luna的无限日常对话。这次更新扩大了高级模型的覆盖范围,降低了使用门槛。
事件专题

推荐理由:OpenAI给GPT-5.6 Sol做了升级,免费用户也能用了,还能无限聊Luna版,试试看区别大不大。
00:21
00:21官方一手Google DeepMind: Blog博客/媒体
72°
DeepMind在官方博客发布WeatherNext,将其定位为面向气旋预报的AI模型。该模型利用机器学习技术,在热带气旋路径和强度预测上展示了新的能力。官方称这是气旋预报领域的一次突破。

推荐理由:DeepMind出了个新模型WeatherNext,专门用来预测气旋(台风/飓风),说是预报精度有突破,关心极端天气的可以看看。
8月6日
21:51
21:15
21:15官方账号Decoder@Maximilian Schreiner
精选
Meta发布了Muse Spark 1.2和编程智能体Muse Code,后者设计用于在崩溃后恢复工作。最便宜档每百万输出token仅20美分,但要求用户共享数据用于训练。Meta以价格而非顶级性能参与竞争,基准测试中存在明显差距。
事件专题

推荐理由:Meta这次拼价格,Muse Code崩了能接着干,最便宜档20美分每百万token,但得拿数据来换。
15:45
10:29
10:29官方一手pandaily@contact@pandaily.com (Pandaily)
81°
DeepSeek V4 Flash以7.1万亿token登顶OpenRouter周度token使用量榜首。榜单前五名中已有四款中国模型,OpenAI随即把GPT-5.6 Luna的价格下调80%。梁文锋的“硬汉”表情包在社交网络走红,进一步放大了外界对中国大模型全球竞争力的关注。
事件专题

推荐理由:中国模型前五占四,DeepSeek V4 Flash一周跑7.1万亿token,OpenAI直接砍价80%,这仗打得真热闹。
08:47
8月5日
21:38
21:38官方账号Decoder@Matthias Bastian
Black Forest Labs推出FLUX 3 Video,能生成最长20秒的全高清视频,并自带原生音频和唇形同步对话,支持超过14种语言。该模型还能直接在场景中渲染文字。BFL公布的Elo排行榜显示,FLUX 3 Video的评分高于Gemini Omni Flash和Seedance 2.0。
事件专题

推荐理由:Black Forest Labs出了FLUX 3 Video,能生成20秒带原生声音和口型对上的视频,还说自己比Seedance 2.0强,去看看效果吧。
16:51
16:26
16:26官方一手Pandaily@contact@pandaily.com (Pandaily)
腾讯通过WorkBuddy、Tencent Design Miora和TokenHub三个平台向国际市场开放旗舰Hy3大模型。WorkBuddy上的Hy3模型免费使用截止到2026年8月31日。该模型是腾讯在AI领域的重要布局,此次国际开放旨在扩大其全球影响力。
事件专题

推荐理由:腾讯把Hy3模型放到国际上了,WorkBuddy上免费用到8月底,想试试国产大模型的可以去玩。
16:17
16:17官方一手pandaily@contact@pandaily.com (Pandaily)
独立机构SaferAI对Zhipu GLM-5.2的审计显示,其网络攻击能力与GPT-5.5持平,但缺少内容过滤护栏。审计中76%的安全漏洞可被复现,模型对恶意请求的拒绝率为0%。这一结果暴露了开源权重版本在部署时的结构性风险。

推荐理由:SaferAI测了Zhipu的GLM-5.2,攻击力比肩GPT-5.5,但零内容过滤,开源风险不小。
15:47
15:44
15:44IT之家博客/媒体
小米于8月5日宣布开源具身基座模型 Xiaomi-Robotics-1。该模型基于超10万小时UMI数据预训练,并使用超1万小时跨本体数据后训练。开源内容包括真机后训练到模型部署的完整流程,并附带Benchmark评测代码。项目已在GitHub和Hugging Face上公开。

推荐理由:小米把训练好的机器人模型开源了,10万小时数据打底,还附评测代码,做具身智能的可以直接上手试试。
10:26
10:26官方一手pandaily@contact@pandaily.com (Pandaily)
75°
阿里巴巴发布Qwen3.8旗舰模型,总参数2.4T,激活参数95B。同时推出千问办公智能体,面向企业AI工作流。该组合依托钉钉的企业生态,与腾讯WorkBuddy、字节豆包展开直接竞争。
事件专题

推荐理由:阿里发了Qwen3.8,总参数2.4T,还带了办公智能体,直接跟豆包和WorkBuddy抢企业客户。
07:38
07:38IT之家博客/媒体
72°
马斯克在 SpaceX 财报电话会议上预告,Grok 4.6 将于下周发布,总参数量为 1.5 万亿。该模型重点改进监督微调(SFT)和强化学习(RL)技术。他还透露未来 3~4 周将推出 Grok 4.7,参数量达 2.1 万亿。

推荐理由:马斯克说 Grok 4.6 下周就来,1.5 万亿参数,重点改了监督微调和强化学习,可以先蹲一波。
04:14
04:14techcrunch@Rebecca Bellan
SaferAI发布新报告,评估Z.ai的开源权重模型GLM-5.2。该模型在多项基准上接近前沿闭源模型,但缺少关键安全缓解措施。报告指出,开源模型的快速进展可能超过现有治理与防护机制。
推荐理由:SaferAI的报告说,Z.ai的开源模型GLM-5.2已经快追上顶级闭源模型,但安全防护没跟上,搞开源的朋友得看看。
02:48
02:48官方一手marktechpost@Asif Razzaq
Cursor Research开源了MoK,这是支撑Composer模型的MoE训练内核。MoK将专家混合的全部通信与计算融合进单个确定性内核。在GB300 NVL72机架上,MoK比最强公开基线快2.37倍。它需要Blackwell SM100或SM103 GPU,没有NVL72算力的用户无法使用。
事件专题

推荐理由:Cursor把训练内核MoK开源了,在GB300 NVL72上比最强公开基线快2.37倍,但得先有NVL72机器才能跑。