7月1日
05:18
05:18Google AI Developers@googleaidevs
72°
Google推出Nano Banana 2 Lite,号称最快、最经济的Gemini图像模型,专为高吞吐量开发者管道优化。同时发布的Gemini Omni Flash支持视频生成和编辑。两款模型即日起通过Google AI Studio和Gemini API可用。
事件专题

推荐理由:Google发了两个新模型:Nano Banana 2 Lite图像模型更快更省钱,还有Gemini Omni Flash能做视频生成和编辑,今天就能在API上用了。
04:26
04:26官方账号Runway ML@runwayml
Runway 宣布集成 Gemini Omni Flash 模型,支持用户通过文本提示、图片或视频输入来生成和编辑视频内容。该功能允许用户使用自然语言或现有素材创作任意视频。用户可在 Runway 平台直接使用,或通过 Agent 调用 Omni 能力。
推荐理由:Runway 把 Gemini Omni Flash 塞进视频工具里了,用一句话、一张图或一段视频就能编辑和生成新内容,省掉繁琐剪辑。
04:21
04:21lmarena.ai@lmarena_ai
精选
Gemini Omni Flash在Video Arena的视频编辑任务中排名第二,得分1347。它比第三名HappyHorse 1.0(1308分)高出近40点。该模型现可通过Gemini API和Google AI Studio使用。同时发布的还有Nano Banana 2 Lite,号称最快最便宜的Gemini图像模型。
事件专题

推荐理由:Google DeepMind的Gemini Omni Flash视频编辑能力强,比对手高40分,还发布了更便宜的图像模型Nano Banana 2 Lite。
03:18
03:06
03:06官方账号Microsoft Research@MSFTResearch
精选
微软研究院提出SkillOpt方法,解决AI智能体因手动修改指令导致行为不可靠的问题。SkillOpt将技能编辑转化为训练过程,优化智能体行为而不改变模型权重。实验表明该方法在多个基准测试中提升任务成功率。
推荐理由:微软出了个SkillOpt,把改智能体指令这事变成自动训练,不改模型参数就能让行为更稳,适合搞Agent应用的人看看。
02:56
02:56OpenRouter@OpenRouterAI
73°
OpenRouter推出Claude Sonnet 5,促销价格输入$2/M,输出$10/M。该模型强化了智能体编码和专业工作流能力。早期测试显示,相比Sonnet 4.6,其智能体更可靠、任务执行更快,且处理大任务时更易信任。
事件专题

推荐理由:OpenRouter上了Claude Sonnet 5,价格比官方低,智能体编程更稳更快,值得试试。
02:44
02:44HeyGen@HeyGen_Official
73°
HeyGen Models 实现了30分钟单次AI视频生成,是此前行业上限的6倍。关键技术在于解决了长视频中的面部漂移问题,确保身份特征全程一致。完整技术报告已公开,详细说明了模型架构与训练方法。

推荐理由:HeyGen 搞了个30分钟长视频生成,脸一直没崩,比行业水平强6倍,建议看看技术报告了解怎么做到的。
02:21
02:21OpenRouter@OpenRouterAI
76°
Anthropic 发布了 Claude Sonnet 5,称其为最具代理性的 Sonnet 版本。该模型能够自主制定计划并使用浏览器、终端等工具。其自主运行水平达到几个月前需要更大更贵模型才能实现的程度。
事件专题

推荐理由:Claude Sonnet 5 能自己用浏览器和终端执行任务,比之前更自主,适合想省心的人。
02:08
02:08官方账号OpenAI@OpenAI
精选
OpenAI推出GeneBench-Pro,这是一个面向AI agent的研究级基准测试。该基准要求agent在混乱的生物数据中导航并选择正确的分析路径。它旨在衡量AI在真实计算研究中的判断能力,而非简单准确率。
事件专题

推荐理由:想看看AI分析生物数据能多聪明?OpenAI这个新测试专考agent的判断力,挺有意思的。
01:51
01:51官方账号Jim Fan@jimfan
精选
NVIDIA GEAR lab 联合 UMich、Berkeley、CMU 推出 ASPIRE,这是首个自动化机器人技能发现系统。它不逐个解决任务,而是持续发现并积累可复用技能,作为机器人智能的构建模块。ASPIRE 支持多任务迁移、sim-to-real 迁移以及跨实体迁移。相关论文和项目页面已在 research.nvidia.com 发布。
事件专题

推荐理由:NVIDIA 和几个顶级高校联手搞了个新系统 ASPIRE,能自动发现并存下可复用的机器人技能,跨任务、跨仿真到现实、跨机器人本体都能迁移,挺有看头。
00:52
00:52官方账号Logan Kilpatrick@OfficialLoganK
精选
Google 发布两款新生成式媒体模型 Nano Banana 2 Lite 和 Gemini Omni Flash,集成在 Gemini API 和 AI Studio 中。Nano Banana 2 Lite 图像生成速度低于 4 秒,成本仅 $0.034/千张。Gemini Omni Flash 在视频编辑任务上达到 SOTA,定价 $0.10/秒,与 Veo 3.1 Fast 相同。两者均强调高效与低成本。
事件专题

推荐理由:Google 发了两款新模型:一个 4 秒出图、千张只要 3 分 4;另一个视频编辑达到 SOTA 且和 Veo 3.1 Fast 一样便宜。
6月30日
22:50
22:50官方账号阶跃星辰 Stepfun@Stepfun_AI
Step 3.7 Flash 本月在 OpenRouter 平台上处理了4.29万亿 tokens,进入该平台流量前十。开发者将其用于真实 agent 运行、编程任务和长上下文工作流。模型在处理复杂任务时表现稳定,获得社区积极反馈。

推荐理由:Step 3.7 Flash 在 OpenRouter 上月流量超4万亿 tokens,开发者拿它跑智能体、写代码,又稳又快。
22:47
22:47小互@imxiaohu
Google 将在今晚发布新 🍌 模型和低配版 Omini 模型。同时,消息称 Anthropic 的 Claude Sonnet 5 也将在今晚亮相。OpenAI 目前尚未公布任何动态。这三个模型发布集中在同一晚,引发社区关注。
事件专题

推荐理由:今晚三个模型扎堆发:Google 的🍌和Omini低配版,加上Claude Sonnet 5,都是新东西,可以蹲一波。
15:36
13:17
13:17Geek@geekbb
精选
Qwythos 9B 基于 Qwen3.5-9B,在 5 亿 token 的 Claude 思维链轨迹上全参数微调,可处理 1M 上下文。支持原生 Function Calling 和多模态视觉(图像+文本)。GGUF 量化后仅 5.2 GiB,可在低配设备上运行。该模型为开源且未经审查。
推荐理由:Empero AI 开源的 Qwythos 9B 把 Qwen3.5 和 Claude 思维链结合,1M 上下文加 Function Calling,量化后 5.2GB 的推理模型,低配机器也能跑。
12:49
12:49官方账号阶跃星辰 Stepfun@Stepfun_AI
Step 3.7 Flash 在 Nous Portal 上获得实际应用,用户正在用它测试、构建和运行各种智能体工作流。该项目由 Nous Research 合作推进,并保持免费访问。官方邀请用户试用并分享成果。
推荐理由:快去 Nous Portal 上免费试用 Step 3.7 Flash,用它搭建各种智能体工作流,体验它的实际效果。
12:48
12:35
12:13
12:13AI Will@FinanceYF5
Meta开源了Brain2QWERT非侵入式脑机接口的v1和v2完整训练代码。合作方BCBL同步公开了v1版本的数据集,v2数据集暂未开源。这项开源大幅降低了脑机接口研究的门槛,非侵入式方案的准确率较以往有明显提升。

推荐理由:Meta把脑机接口代码全开源了,合作方BCBL还给了v1数据集,准确率上了一个台阶,搞脑机接口的可以赶紧上手试试。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。