01:20lmarena.ai@lmarena_aiVideo Edit Arena 公开了完整排行榜详情。详细榜单数据可在 arena.ai/leaderboard 查看。这是视频编辑领域的一次公开排名。行业Video Edit Arenaarena.ai视频编辑推荐理由:想看视频编辑谁最强?去 arena.ai/leaderboard 看完整榜单吧。原文稍后读已读值得跟进有用关注 Video Edit Arena
00:53lmarena.ai@lmarena_ai在视频编辑竞技场(Video Edit Arena)中,MiniMax-H3以1390分位列开源模型和总榜第一。它比第二、第三名的Dreamina Seedance 2.0和Gemini Omni Flash高出32分,比第四名HappyHorse 1.0高出83分。MiniMax官方已宣布该模型在Hugging Face上公开发布。AI模型MiniMax-H3MiniMax视频编辑2 个信源在谈事件专题推荐理由:MiniMax-H3登顶视频编辑榜,领先Seedance和Gemini 32分,已开源可下载。原文稍后读已读值得跟进有用关注 MiniMax-H3
22:04官方账号Runway ML@runwaymlScene Fixer 由 AL Anany 开发,面向 Runway 用户的 AI 视频片段修复工具。用户将不匹配的片段序列放入,其视觉 AI 会自动标记服装、道具、灯光、视线等问题区域。用户确认位置后,Aleph 只修复该处,其他帧保持逐帧一致,音频不变。无需重新生成整个片段。AI产品Scene FixerRunwayAleph推荐理由:Runway 出了个 Scene Fixer,能把不搭的 AI 片段统一起来,只修有问题的部分,其他帧和音频都不动。原文稍后读已读值得跟进有用关注 Scene Fixer
17:44宝玉@dotey精选76°开发者把视频编辑 App 从 Electron 迁移到 Swift + AppKit,用 Fable 5 还原 UI 完成 Mac 版。随后用 Rust 写跨平台 CLI,音频转录和视频导出性能比 Swift 更好。为支持 Windows,又用 GPUI 分别让 GPT 5.6 Sol、Grok 4.6 + Cursor、Claude + Fable 各写一版 PoC,其中 Claude + Fable 版本效果相对最好。三个 PoC 验证了方向可行,BaoCut Skill 也已在 Windows 端支持转录和翻译视频。技巧RustGPUIFable 510 个信源在谈事件专题推荐理由:他用 Rust+GPUI 试了 GPT、Grok、Claude 三版 PoC,对比很具体,做视频工具跨平台可以参考。原文稍后读已读值得跟进有用关注 Rust
06:57官方账号Pika Labs@pika_labsPika Labs在社交平台展示了Seedance 2.5的视频编辑能力。仅用一张图像参考,就能改变复杂序列中的整个视觉环境,包括风景和主要主体。同时宣布Seedance 2.5在Pika API Club最高提供88%折扣。AI产品Seedance 2.5Pika视频生成8 个信源在谈事件专题推荐理由:Pika把Seedance 2.5的视频编辑玩出花了,一张参考图就能换整个场景,API还打88折,做视频的可以看看。原文稍后读已读值得跟进有用关注 Seedance 2.5
09:54IT之家(博客/媒体)精选京东开源的 JoyAI-Video-Edit 是一款实时流式视频编辑模型,在 720P 分辨率下达到每秒 30 帧的推理速度。它支持任意时长的连续编辑,用户可在视频播放过程中实时修改场景、替换物体或调整人物形象。在与 SANA Streaming、LiveEdit、Xmax-X2.0 的对比中,该模型在典型编辑场景下全面领先。在 OpenVE-Bench 通用评测中,它超越了所有流式编辑方法,尤其在全局风格、局部替换、局部删除和字幕编辑任务上优势突出。该模型还可将人手操作视频转化为机械臂操作素材,用于具身智能训练数据合成。AI模型JoyAI-Video-Edit京东视频编辑推荐理由:京东开源 JoyAI-Video-Edit,边看边改视频,720P 30帧/秒、任意时长,效果超 LiveEdit,还能生成机器人训练数据。原文稍后读已读值得跟进有用关注 JoyAI-Video-Edit
14:11Hailuo AI@Hailuo_AI创作者 @ponzponz15 用 MiniMax H3 测试绿幕编辑。他上传了原视频、编辑后视频和参考图像,验证 H3 能否在保持相机运动与人物位置的同时,将背景和服装替换为参考图像的世界观。测试结果显示,编辑后的画面在部分场景中轮廓反而更清晰。H3 支持参考图像转换、相机运动测试和时间一致性。AI模型MiniMax H3视频编辑多模态7 个信源在谈事件专题推荐理由:海螺AI官方转发了用户用MiniMax H3做绿幕编辑的测试,换背景和衣服还能保持镜头和人物不动,编辑后轮廓还更清楚,挺有意思。原文稍后读已读值得跟进有用关注 MiniMax H3
10:34官方账号arXiv cs.AI@Yueyi Liu, Chi Zhang, Sen Cui, Miao Liu测试时调优(TTT)在预训练扩散模型中用于视频编辑,但存在Prior Collapse问题,导致模型丢弃文本条件和空间潜在变量。ElasticTTT通过目标分布正则化防止过拟合记忆,对比CFG引导推理远离源偏置,以及异步噪声调度保留未编辑区域。在一次性视频编辑任务上,该方法相较现有TTT方法实现了更优的语义保真度和编辑质量。论文ElasticTTT视频编辑扩散模型推荐理由:这篇论文解决了视频编辑时模型丢失先验的问题,用三种新技巧让编辑更精准,效果比以前的TTT方法好得多。原文稍后读已读值得跟进有用关注 ElasticTTT
22:49IT之家(博客/媒体)精选京东在 2026 年 WAIC 上推出 JoyAI-Talker 实时语音交互模型,具备低延迟对话、情绪理解和声纹识别功能。同时发布 JoyAI-Video-Edit 视频编辑模型,支持通过自然语言增删物体、替换人物等流式编辑。京东还开源了行业最大的人类视角数据集 EgoLive。AI模型JoyAI-TalkerJoyAI-Video-Edit京东推荐理由:京东一口气发了两个 AI 模型,一个能实时语音聊天还能认声纹,另一个视频编辑可以边看边改,挺实用的。原文稍后读已读值得跟进有用关注 JoyAI-Talker
02:13Justine Moore@venturetwinsDecartAI推出Nano Banana模型,允许用户通过视频或文本提示编辑直播流。用户上传场景截图作为参考图像,输入文本指令(如将女人改为穿背心的网红),模型能保留原光照效果。该功能基于参考图像进行编辑,无需从头生成。演示中展示了从截图到修改后画面的流程。AI模型DecartAINano Banana视频编辑推荐理由:DecartAI发了Nano Banana,能让你用视频或一句话改直播画面,上传截图就能保留原光照,挺好玩的。原文稍后读已读值得跟进有用关注 DecartAI
00:16宝玉@dotey@xiaoweiai2025提到pi很好但小众,目标是开发一个给Agent辅助视频编辑的skill,而非视频编辑Agent。该推文有1条评论和1个点赞。AI产品pi视频编辑Agent推荐理由:想了解pi和Agent辅助视频编辑思路的可以看看,小众但有方向。原文稍后读已读值得跟进有用关注 pi
02:40官方一手marktechpost@Sana Hassan精选本教程演示如何搭建一个无需API密钥的多智能体视频编辑流水线,包含意图解析器、智能体库、工具路由器(连接FFmpeg、Whisper语音转写、场景检测等8个组件)以及图规划器,并引入文本梯度优化器自动修复执行图。最终系统能根据自然语言指令回答视频内容问题、生成摘要并产出编辑产物。所有组件均基于开源工具实现,不依赖外部商业服务。技巧VideoAgentFFmpegWhisper推荐理由:手把手教你用FFmpeg+Whisper搭视频编辑Agent,不用API密钥,还能自动修复执行图,比纯AI工具更可控。原文稍后读已读值得跟进有用关注 VideoAgent
22:37Hailuo AI@Hailuo_AIMiniMax Hub 发布官方指南第三集,重点介绍 Magic Toolbar 的三大功能:Erase(擦除)可移除画面中不需要的部分;Crop(裁剪)支持智能重新构图和位置调整;Split Grid(分格)一键生成故事板和社交媒体帖子。这些工具集成在 MiniMax Hub 平台内,旨在简化视频和图像编辑流程。技巧MiniMax HubMagic Toolbar视频编辑推荐理由:MiniMax Hub 的魔法工具栏能一键擦除、裁剪和分格,做故事板或发社交图都超方便,值得试试。原文稍后读已读值得跟进有用关注 MiniMax Hub
21:59shao__meng@shao__meng精选ChatCut 发布 Codex 官方插件,将 Codex 接入 ChatCut MCP 协议。插件包含 15 个预设工作流 Skills,支持 Agent 在真实多轨时间线上执行导入、剪辑、生成、字幕、导出等操作。插件不包含剪辑内核,核心为插件元数据、MCP 连接配置、Skills 和遥测 Hooks。用户可通过 ChatCut 网站一键安装,复制指定命令即可启用。技巧ChatCutCodexMCP推荐理由:想用 AI 自动剪辑视频?ChatCut 出了 Codex 官方插件,把 Codex 接到 MCP,15 个现成工作流就能帮你完成导入、剪辑、导出一条龙。原文稍后读已读值得跟进有用关注 ChatCut
03:22techcrunch@Aisha MalikGoogle Photos 推出新的 AI 'Video Remix' 工具,可为视频应用电影级重新照明,自动提亮暗色片段。用户还能一键将平淡背景替换为趣味场景,或添加多种艺术风格效果。该功能目前未说明具体支持设备或时间安排。AI产品Google PhotosVideo Remix视频编辑推荐理由:Google Photos 上线了一个 AI 视频编辑工具,可以给暗视频补光、换背景、加艺术效果,省得自己手动调。原文稍后读已读值得跟进有用关注 Google Photos
09:21官方账号Google DeepMind@GoogleDeepMindGoogle DeepMind 推出 Gemini Omni Flash,支持通过自然语言进行会话视频编辑。该模型可同时引用图片、文本和视频帧,组合多模态输入来操控视频动作。它还能利用真实世界知识,直接连接文字与图形到视频输出。目前已在 Google AI Studio、Gemini API 及 Gemini Enterprise Agent Platform 可用。AI模型Gemini Omni FlashGoogle DeepMind多模态推荐理由:Google DeepMind 的新模型 Gemini Omni Flash 能边聊天边剪视频,还能把文字和图片直接变成视频操作,很实用。现在在 Google AI Studio 就能试。原文稍后读已读值得跟进有用关注 Gemini Omni Flash
06:49IT之家(博客/媒体)苹果昨日宣布升级 Apple 创作坊,增强 Final Cut Pro 等应用的联动。Final Cut Pro 新增 Generate Captions 功能,利用设备端 AI 自动转写音频并生成字幕;Edit Detection 可分析已渲染视频并自动拆分回原始片段。Mac 用户还可使用 Auto Mask 自动识别皮肤、头发等元素。新订阅价格为每月 38 元或每年 380 元,教育优惠每月 18 元或每年 180 元。AI产品Apple创作坊Final Cut ProAI工具推荐理由:苹果把 Final Cut Pro 等软件的 AI 功能打包进创作坊,年费 380 元就能用上自动字幕、AI 遮罩这些实用工具,视频创作者别错过。原文稍后读已读值得跟进有用关注 Apple创作坊
06:12Philipp Schmid@_philschmid谷歌发布了名为 gemini-omni-flash-api 的技能,通过 npx skills add google-gemini/gemini-skills --skill gemini-omni-flash-api 即可集成到 Agent。该技能支持文本转视频、图片参考转视频、首帧转视频以及对话式视频编辑四种核心工作流。视频内容由 Omni Flash 模型生成并编辑,无需额外视频处理工具。AI产品Omni FlashGemini视频编辑推荐理由:谷歌给 Omni Flash 加了个视频编辑技能,一行命令就能让 Agent 做视频,支持文本、图片、首帧三种输入,还能对话式编辑,挺实用的。原文稍后读已读值得跟进有用关注 Omni Flash
04:26官方账号Runway ML@runwaymlRunway 宣布集成 Gemini Omni Flash 模型,支持用户通过文本提示、图片或视频输入来生成和编辑视频内容。该功能允许用户使用自然语言或现有素材创作任意视频。用户可在 Runway 平台直接使用,或通过 Agent 调用 Omni 能力。AI模型RunwayGemini Omni Flash视频生成推荐理由:Runway 把 Gemini Omni Flash 塞进视频工具里了,用一句话、一张图或一段视频就能编辑和生成新内容,省掉繁琐剪辑。原文稍后读已读值得跟进有用关注 Runway
01:53elvis@omarsar0Google发布两款新生成式媒体模型:Nano Banana 2 Lite和Gemini Omni Flash。Nano Banana 2 Lite生成单张图像速度小于4秒,价格为每千张0.034美元。Gemini Omni Flash在视频编辑任务上达到SOTA,每小时成本0.10美元,与Veo 3.1 Fast相同。这些定价远低于行业平均水平,有助于降低开发者构建AI应用的门槛。AI模型Nano Banana 2 LiteGemini Omni FlashGoogle10 个信源在谈事件专题推荐理由:Google把图像生成价格打到每千张3分钱,速度不到4秒,还能编辑视频,做教育科研的可以试试。原文稍后读已读值得跟进有用关注 Nano Banana 2 Lite
00:52官方账号Logan Kilpatrick@OfficialLoganK精选Google 发布两款新生成式媒体模型 Nano Banana 2 Lite 和 Gemini Omni Flash,集成在 Gemini API 和 AI Studio 中。Nano Banana 2 Lite 图像生成速度低于 4 秒,成本仅 $0.034/千张。Gemini Omni Flash 在视频编辑任务上达到 SOTA,定价 $0.10/秒,与 Veo 3.1 Fast 相同。两者均强调高效与低成本。AI模型Nano Banana 2 LiteGemini Omni FlashGoogle10 个信源在谈事件专题推荐理由:Google 发了两款新模型:一个 4 秒出图、千张只要 3 分 4;另一个视频编辑达到 SOTA 且和 Veo 3.1 Fast 一样便宜。原文稍后读已读值得跟进有用关注 Nano Banana 2 Lite
07:43官方账号Runway ML@runwaymlRunway API 推出 Recipes 功能,这是预构建的生成式媒体端点,内含 Runway 的提示词和工作流专业知识。用户只需一次 API 调用即可将功能集成到平台中,无需自行构建和维护工作流。示例包括从图片生成产品广告、在现有视频中替换产品等。该功能支持大规模商用。AI产品RunwayAPIRecipes推荐理由:Runway 的 Recipes 用一条 API 就能给你的平台加上生成式广告和视频替换功能,省去自己搭工作流的麻烦。原文稍后读已读值得跟进有用关注 Runway
12:01宝玉@doteyAgent默认生成HTML结果,可在其内置浏览器中打开。用户暂停视频播放后,用鼠标标记要修改的具体位置。Agent会根据标记在对应区域进行修改,实现局部微调。该方法无需从头生成,节省时间且精准。技巧AgentHTML浏览器推荐理由:想用Agent微调视频?在它生成的HTML里标记位置让它改,比重新生成省事多了。原文稍后读已读值得跟进有用关注 Agent
02:32官方账号Pika Labs@pika_labsPika Labs 通过 MCP 接口推出 Language Swap 技能,允许用户将视频中的语音替换为其他语言,同时保留原声的音色和口型。该功能支持 40 多种语言,可自动生成字幕并选择多种样式。创作者只需一条指令即可让视频中的自己说任何语言,极大降低了多语言内容制作的门槛。目前该功能已在 Pika MCP 中可用。AI产品PikaMCP/工具语音克隆推荐理由:做多语言视频内容的创作者终于可以省去重新录制和配音的麻烦——Pika 的 Language Swap 直接克隆你的声音并换语言,还带字幕,做短视频或跨国营销的团队值得立刻试试。原文稍后读已读值得跟进有用关注 Pika
23:55Replicate@replicatePrunaAI 的 P-Video-Replace 模型已上线 Replicate,号称是现有视频中角色替换速度最快的模型。该模型在 720p 下生成每秒视频仅需 3.58 秒,比同类方案快约 10 倍,且价格仅为 $0.009/秒(限时 70% 折扣)。用户只需上传源视频、1-4 张参考角色图像和指令提示,即可替换视频中的角色,保持背景不变。适用于 UGC 广告变体、迷因混剪、电影重选角、游戏过场动画和教育视频等场景。AI产品视频编辑角色替换PrunaAI推荐理由:做视频编辑、广告创意或内容混剪的团队,终于有了一个又快又便宜的角色替换方案——比传统方案快 10 倍、价格低一个数量级,建议直接上手试。原文稍后读已读值得跟进有用关注 视频编辑
00:17Replicate@replicateRunwayML 在 Replicate 上发布了 Aleph 2.0,这是一次视频编辑的重大升级。它支持对最长 30 秒、1080p 分辨率的视频进行局部编辑,只需输入提示词即可改变光照、替换产品、移除物体或重新设计整个视频风格。该工具旨在简化视频后期制作流程,让创作者无需复杂软件即可实现专业级效果。AI产品视频编辑RunwayMLAleph 2.0推荐理由:视频创作者和编辑人员现在可以用自然语言指令快速修改视频细节,省去繁琐的手动操作,值得一试。原文稍后读已读值得跟进有用关注 视频编辑
23:59官方账号Runway ML@runwayml精选Runway 发布 Aleph 2.0,可将任意视频直接转换为绿幕素材或干净底板,无需手动 rotoscoping。该功能通过 AI 自动分离前景与背景,简化后期制作流程。Runway Academy 教程演示了具体操作步骤,适合视频编辑和特效工作者。技巧Aleph 2.0Runway视频编辑推荐理由:学用Aleph 2.0,视频秒变绿幕原文稍后读已读值得跟进有用关注 Aleph 2.0
08:28官方账号Runway ML@runwayml72°Runway 宣布其视频编辑模型 Aleph 2.0 现已通过 API 开放。该模型支持对最长 30 秒、1080p 的多镜头视频进行精准编辑,用户可以仅修改视频中的特定部分,而无需重新生成整个片段。开发者可将此能力直接集成到自己的应用、产品或平台中,为视频编辑工作流带来更高的可控性和效率。这标志着 AI 视频编辑从“生成”向“精准编辑”迈出了重要一步。AI产品Runway视频编辑API推荐理由:做视频工具或内容平台的开发者终于有了可集成的精准编辑能力——Aleph 2.0 让你在 1080p 多镜头视频中只改想改的部分,建议直接接入 API 试试。原文稍后读已读值得跟进有用关注 Runway
12:07AI Will@FinanceYF5Google 展示了其 Gemini Omni 模型的新能力,允许用户通过自然语言指令改变视频中的摄像机角度、调整视角或修改光照效果,同时保持物理规律和角色一致性。演示中,用户输入“把场景改成沙漠(其他不变)”,视频即被重新渲染。这一技术突破了传统视频编辑的局限,为内容创作者提供了前所未有的灵活性和控制力。它标志着多模态 AI 在视频理解和生成方面的重要进展,有望简化影视制作、广告和社交媒体内容创作流程。AI产品Gemini Omni视频编辑多模态AI推荐理由:视频创作者和后期团队终于可以像改文字一样改视频了——Gemini Omni 让你一句话调整视角和光照,还保持物理和角色一致,做内容生产的建议点开看看怎么用。原文稍后读已读值得跟进有用关注 Gemini Omni
15:13官方一手pandaily@contact@pandaily.com (Pandaily)LINKER Technology 在 BEYOND Expo 2026 上推出了 OttoBox,一款基于自研 OmModel 多模态模型的 AI 视频创作助手。该工具将视频粗剪时间从传统的 8 小时大幅缩短至 30 分钟,显著提升视频制作效率。OttoBox 利用 AI 自动识别关键片段、生成剪辑建议,并支持快速导出。这一产品面向内容创作者、视频编辑团队和营销人员,有望降低视频制作门槛。AI产品AI 视频创作多模态模型OttoBox推荐理由:视频创作者和剪辑团队终于有了能真正省时间的 AI 工具——粗剪效率提升 16 倍,建议做短视频或营销内容的直接试用。原文稍后读已读值得跟进有用关注 AI 视频创作
03:03Google Gemini App@GeminiApp精选Gemini App 宣布印度用户现在可以上传视频并使用 Gemini Omni 进行编辑和变换。该功能支持从相机胶卷或保存的文件中上传。Gemini Omni 被描述为在 Vibe 视频编辑方面超越一切。目前该更新是否会在印度以外地区推出尚未明确。AI产品Gemini AppGemini OmniGoogle推荐理由:谷歌推出 Gemini Omni 视频编辑原文稍后读已读值得跟进有用关注 Gemini App
01:48Ethan Mollick@emollick76°Ethan Mollick 指出,Gemini Omni 与其他视频 AI 的关键区别在于其完全多模态能力,可以原生编辑视频。他展示了将1896年经典电影《火车进站》中的火车改为子弹头列车、乐高风格,并添加时间旅行者、蜈蚣和布偶等元素。视频中甚至保留了反射效果,体现了 Gemini Omni 对视频内容的深度理解和编辑能力。这一演示凸显了 Gemini Omni 在视频生成和编辑领域的独特优势。AI产品Gemini Omni多模态视频编辑推荐理由:Gemini Omni 的原生视频编辑能力让创作者可以直接在视频中做复杂修改,做视频内容或 AI 应用的开发者值得关注,看看它如何理解并重构视频场景。原文稍后读已读值得跟进有用关注 Gemini Omni
00:53官方账号Runway ML@runwayml76°Runway 昨日发布了 Aleph 2.0,这是其升级版视频编辑模型,允许用户精确修改视频中的特定元素,同时保持其他内容不变。该模型集成在全新的 Edit Studio 中,支持最长 30 秒、1080p 分辨率的多镜头序列编辑。用户可以通过 Runway Academy 学习如何上手使用。这一更新显著提升了视频编辑的灵活性和精度,适合内容创作者和视频制作团队。AI产品RunwayAleph 2.0视频编辑推荐理由:视频创作者终于可以精准修改画面中的特定元素而不影响整体,做短视频、广告或影视后期的人可以直接在 Edit Studio 里试,30 秒 1080p 多镜头支持让复杂剪辑更高效。原文稍后读已读值得跟进有用关注 Runway
02:34官方账号Runway ML@runwayml精选Runway推出Aleph 2.0版本,新增单帧编辑功能。用户可以在视频中编辑某一帧,预览更改效果,然后Aleph 2.0自动将该编辑传播到整个视频。该功能已在新的Edit Studio网页版上线。AI产品RunwayAleph视频编辑推荐理由:Runway的Aleph 2.0能让你改一帧全片跟着变原文稍后读已读值得跟进有用关注 Runway
07:59官方一手歸藏(guizang.ai)@op741883°谷歌在 I/O 2026 前夕通过 Sundar Pichai 的推文展示了新视频模型的演示,确认该模型支持视频编辑功能。目前尚不清楚视频编辑与生成是统一模型还是分开实现。该演示引发社区关注,预示着谷歌在视频 AI 领域的新进展。更多细节将在 I/O 2026 上公布。AI产品谷歌视频模型视频编辑推荐理由:视频编辑是 AI 视频生成的关键痛点,做视频创作或 AI 应用的开发者值得关注谷歌的解法。原文稍后读已读值得跟进有用关注 谷歌
06:03rohanpaul_ai@rohanpaul_ai83°Google 推出 Gemini Omni,一个能从视频、图像、音频、文本和草图等多种输入生成并编辑视频的 AI 模型。用户只需用自然语言描述,即可添加角色、替换物体、改变动作、调整风格、同步声音或移动镜头,且每次编辑后场景保持稳定。Omni 具备更强的世界理解能力,能更真实地模拟重力、流体运动、动能和物理交互。该模型将集成到 Gemini 应用、Google Flow 和 YouTube Shorts 中。Google 还为 Omni 输出添加了 SynthID 水印和 C2PA 内容凭证,以标识 AI 生成或编辑的媒体。AI产品Gemini Omni视频生成视频编辑2 个信源在谈事件专题推荐理由:视频创作者和内容团队终于有了一个能像导演一样反复指导修改的 AI 工具,而非一次性的 prompt 生成。做短视频、广告或影视后期的人,可以直接用自然语言调整画面细节,值得关注。原文稍后读已读值得跟进有用关注 Gemini Omni
04:16官方账号Demis Hassabis@demishassabis精选Demis Hassabis 宣布 Gemini Omni 在多模态理解与编辑方面取得重大进展。该模型能处理照片、视频和音频输入,并构建全新场景。初期从视频开始,未来将支持任意输入与输出。用户可上传自己的视频并在其上迭代想法。AI模型Gemini Omni多模态视频编辑推荐理由:Gemini Omni能处理视频/音频/图片并构建新场景原文稍后读已读值得跟进有用关注 Gemini Omni
03:17官方账号Google AI@GoogleAI精选谷歌AI推出Gemini Omni,支持通过自然语言描述来编辑视频。用户只需说出想改变的内容,就能调整角色、场景和风格。该功能类似Nano Banana对图片的编辑方式,但应用于视频领域。AI产品GeminiOmniGoogle推荐理由:谷歌让你用语言改视频原文稍后读已读值得跟进有用关注 Gemini
03:02IT之家(博客/媒体)72°在 2026 年谷歌 I/O 大会上,谷歌宣布升级 AI 创意平台 Google Flow,整合 Gemini Omni Flash 模型,提升视频编辑的精细度和角色一致性。同时推出 Google Flow Agent,作为智能伙伴辅助头脑风暴、内容生成和后期修改。新增 Flow Tools 支持自然语言定制工作流和工具分享,Flow Music 则提供更细粒度的分段编辑和重制功能。这些更新已向全球用户开放,旨在降低创作门槛并增强协作效率。AI产品AI 创意平台视频编辑智能体推荐理由:视频创作者和内容团队终于有了一个能保持角色一致性的 AI 工具,Flow Agent 还能帮你头脑风暴剧情——做短视频或电影制作的人可以直接上手试试。原文稍后读已读值得跟进有用关注 AI 创意平台
01:47Justine Moore@venturetwins精选Google DeepMind 推出 Omni 模型,支持用户上传真实视频并通过文本指令进行编辑,包括改变动作、风格或主体。用户还可以在视频上直接标注请求。示例中,用户要求“每次拍手时更换帽子”,模型成功执行。该功能展示了多模态模型在视频编辑领域的应用。AI产品OmniGoogle DeepMind视频编辑推荐理由:在视频上直接改动作换风格原文稍后读已读值得跟进有用关注 Omni