7月31日
11:12
11:10
11:10OpenRouter@OpenRouterAI
MiniMax 发布开源权重视频模型 Hailuo H3,已上线 OpenRouter。H3 支持文本、图像、音频和视频四种输入,并输出原生音视频。官方定位包括指令驱动编辑、文字/品牌渲染和视频到视频的动作迁移。H3 主打轻量级,可直接在 OpenRouter 上调用。
推荐理由:开源视频模型 H3 上 OpenRouter 了,能按指令改视频、渲染品牌文字,还能视频到视频迁移动作,直接调用很方便。
10:57
10:48
10:48官方一手歸藏(guizang.ai)@op7418
精选
Seedance 2.5已在超创平台开放内测,支持一次生成30秒时长的视频。当前版本最高输出分辨率为720P。其全能参考功能允许一次上传最多50张图片作为生成依据。这些参数让该模型在长视频生成和多图参考方面具备明显优势。

推荐理由:Seedance 2.5内测来了,一次能生成30秒视频,还能传50张图做参考,感兴趣就去超创试试。
10:45
10:45AI Will@FinanceYF5
75°
Matt Shumer 发布演示视频,Claude Opus 5 一次生成一个完整游戏。演示中所有画面与逻辑均为模型自定义代码,未使用任何外部素材。该游戏由 Claude Opus 5 单次编码完成,无需人工修改。
推荐理由:Matt Shumer 用 Claude Opus 5 演示了一把生成游戏,画面和逻辑全靠模型自己写,不用任何外部素材,看着挺神奇。
09:56
03:47
03:39
03:39lmarena.ai@lmarena_ai
精选
Thinking Machines 发布 Inkling-Small,总参数量 276B,其中 12B 活跃。该模型在 Text Arena 的 AutoEval 初评中获得 1431 分,排名 #88,并在开放模型中位列 #21。它是美国仅有的五个进入开放模型前 25 的模型之一。初始分数基于 Arena 人类偏好数据训练的奖励模型自动投票得出,待与真实投票验证。
事件专题

推荐理由:Thinking Machines 新出的开源模型,276B 参数但只激活 12B,一发布就挤进 Text Arena 前 100,美国厂商里排前几,想试大参数但轻量推理的可以看看。
03:33
03:33官方账号Sam Altman@sama
OpenAI 在部署后应用 GPT-5.6 Sol 进行效率自优化,让模型自身改进运行效率。结果显示,通过生产 GPU 内核优化,服务成本降低 20%。此外,改进的投机解码使 token 生成效率提升 15% 以上。这一成果展示了模型自我优化的实际收益。
事件专题

推荐理由:OpenAI 的 GPT-5.6 Sol 通过自学习优化运行,服务成本降了 20%,生成速度提了 15%,比手动调优更省心省钱。
02:23
02:22
02:22lmarena.ai@lmarena_ai
精选
Arena在视觉、图像生成和代码领域基于实时偏好训练模态特定奖励模型。文本到图像奖励模型使用超过300万偏好对训练。在公开MMRB2基准上,该模型达到点式奖励模型最先进性能,比次优基线高9分以上。

推荐理由:Arena这个多模态奖励模型真强,文本到图像那块在MMRB2上比第二名高9分多,挺值的看的。
01:56
01:45
01:45Hailuo AI@Hailuo_AI
MiniMax H3 模型成功替换了一个真实商业广告中的产品,所有演员、摄像机移动和阴影均保持原样。该演示由用户 Abdul Shakoor 分享,展示了模型对广告场景的高度还原能力。Hailuo_AI 官方转发了这一案例,引发广泛关注。
事件专题

推荐理由:每个广告公司都应该看看 MiniMax H3 怎么把真实广告里的产品替换掉,演员和镜头完全不变,太强了。
01:15
01:15AI Engineer@aiDotEngineer
Richard Socher在AI Engineer首次Autoresearch环节发表演讲,介绍Recursive_SI正在构建的Eureka机器。该机器旨在实现递归自我改进,推动自动化AI研究。Socher同时指出了当前技术面临的挑战与局限。演讲展示了自动化AI研究的第一步进展。
事件专题

推荐理由:Richard Socher分享了构建递归自我改进AI的Eureka机器思路,展示了自动化研究的早期探索,值得关注。
00:38
00:38官方账号Microsoft Research@MSFTResearch
微软研究院发布EvoLib框架,区别于传统方法仅靠增加记忆,它把模型过往经验提炼为可重用的技能和知识。该框架使LLM在部署后仍能持续学习并适应新任务。EvoLib构建的进化知识库帮助模型调用之前积累的洞见,提升泛化能力。
推荐理由:微软研究院新出的EvoLib,让LLM在部署后还能变聪明,不是死记硬背,而是积累可复用的技能和经验,挺有想法的。
00:08
00:08官方账号Logan Kilpatrick@OfficialLoganK
Google 推出 Gemini Robotics ER 2 模型,已在 Gemini API 和 Google AI Studio 中可用。演示展示了多机器人协作场景,成为亮点。该模型可处理复杂的物理世界交互任务。
推荐理由:Google 新出的 Gemini Robotics ER 2 能直接调 API 玩多机器人协作,看演示很酷,可以试试。
7月30日
23:42
23:42Replicate@replicate
PrunaAI与Ideogram合作发布P-Image-Ideogram模型,专注于高质量风格化图片生成。该模型具备强大的排版和布局能力,优化后推理成本降至每张0.003美元。在风格化生成任务中,P-Image-Ideogram结合了Ideogram的文本渲染优势。
事件专题

推荐理由:想用超低成本生成带精美排版和布局的风格化图片?看看PrunaAI和Ideogram新出的P-Image-Ideogram,每张才3厘钱。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。