10:04官方账号Runway ML@runwaymlRunway 推出了 MCP(Model Context Protocol)服务,允许用户将 Runway 的图像和视频生成能力直接集成到 Claude、ChatGPT、Cursor、Replit 等主流 AI 平台中。该服务支持 Gen-4.5、Seedance 2.0、GPT Images 2.0、Kling 等先进模型,用户无需切换工具即可在原有工作流中生成高质量内容。连接过程仅需数秒,大幅降低了 AI 视频创作的门槛。此举标志着 Runway 从独立工具向平台化生态的转变,为开发者和创作者提供了更灵活的内容生成方式。AI产品RunwayMCP/工具视频生成10 个信源在谈事件专题推荐理由:Runway MCP 让视频生成能力直接嵌入你日常使用的 AI 助手和开发环境,做内容创作或 AI 应用的团队可以秒级接入,省去切换工具的麻烦,值得一试。原文稍后读已读值得跟进有用关注 Runway
09:50Amjad Masad@amasadRunway 推出 MCP 协议支持,允许用户在 Claude、ChatGPT、Cursor、Replit 等主流 AI 工具中直接调用 Runway 的模型生成图像和视频。支持的模型包括 Gen-4.5、Seedance 2.0、GPT Images 2.0、Kling 等。用户只需在代理中连接 MCP 即可使用,无需切换平台。这大幅降低了 AI 视频创作的门槛,让开发者和创作者能在工作流中无缝集成生成能力。AI产品RunwayMCP/工具视频生成10 个信源在谈事件专题推荐理由:做 AI 视频或图像生成的开发者,终于可以在 Replit/Claude 里直接调用 Runway 的顶级模型,不用来回切换工具,建议试试 MCP 连接。原文稍后读已读值得跟进有用关注 Runway
03:53官方账号NVIDIA AI@NVIDIAAI83°Hao AI Lab 开源了 FastVideo Dreamverse 项目,将视频生成速度大幅提升。此前在 8 张 Blackwell GPU 上生成 5 秒视频需约 25 秒,现在单张 Blackwell GPU 仅需 4.2 秒。该技术基于 LTX-2 模型,可在单张 NVIDIA B200 GPU 上 7 秒生成 30 秒 1080p 视频。项目已完全开源,包含代码和博客说明。AI产品视频生成开源/仓库NVIDIA B200推荐理由:视频生成速度从分钟级降到秒级,做 AI 视频创作和实时交互的团队可以直接用开源方案,大幅降低硬件门槛。原文稍后读已读值得跟进有用关注 视频生成
10:52官方一手Pandaily@contact@pandaily.com (Pandaily)精选美团发布LongCat-Video-Avatar 1.5版本,这是一个开源的数字人视频生成框架。该框架在口型同步精度上达到最先进水平,只需8步推理即可生成逼真视频。AI模型LongCat-Video-AvatarMeituan数字人1 个信源在谈事件专题推荐理由:8步推理生成逼真数字人原文稍后读已读值得跟进有用关注 LongCat-Video-Avatar
08:20岚叔@lufzzliz精选本文介绍了如何将 Gemini Omni 用作视频导演工具,核心思路是从描述画面升级为控制系统。Google AI 提供了 5 种 Prompt 方法:调用真实世界知识、控制文字渲染、像摄影师一样写镜头、局部迭代修改、动态修改动作。文章给出了具体的 Prompt 骨架和镜头词库,帮助用户像导演一样控制世界知识、主体动作、镜头语言、文字系统、时间节奏和迭代约束。这种方法让视频生成更精准、可迭代,适合内容创作者和视频制作者直接使用。AI产品Gemini Omni视频生成Prompt 工程推荐理由:做视频生成的内容创作者终于不用靠堆砌形容词碰运气了——这套导演式 Prompt 方法让你像控制分镜一样控制输出,建议直接套用文中的镜头词库和骨架试试。原文稍后读已读值得跟进有用关注 Gemini Omni
22:56官方账号NVIDIA AI@NVIDIAAINVIDIA AI 官方账号发布了一段由 Julia Turc 制作的关于“世界模型”的讲解视频。视频澄清了世界模型与视频生成的区别,探讨了其超越“AI 垃圾”的潜力,并幽默回应了 Yann LeCun 的争议。该视频旨在帮助观众理解这一当前 AI 领域最热门但最模糊的概念之一。AI模型世界模型NVIDIA视频生成2 个信源在谈事件专题推荐理由:世界模型是当前 AI 最模糊的概念之一,这个视频帮你理清它与视频生成的区别,想搞懂 AI 前沿方向的建议点开。原文稍后读已读值得跟进有用关注 世界模型
12:23官方账号arXiv cs.LG@Ali Rouzbayani, Bidhan Roy, Marcos Villagra, Zhiying Jiang精选72°巴黎 2.0 是首个通过去中心化计算预训练的视频生成模型,解决了去中心化训练中时间连贯视频生成的难题。相比相同算力预算下的集中式模型,它在低分辨率文本到视频任务中将 FVD 从 561.04 降至 279.01,提升约 2 倍,同时提高了 CLIP 文本-视频相似度和美学评分。该模型基于巴黎 1.0 的去中心化扩散模型架构,无需单一 GPU 集群即可完成训练。这项工作证明了去中心化训练在视频生成领域的可行性,为降低大规模模型训练门槛提供了新路径。论文视频生成去中心化训练扩散模型推荐理由:去中心化训练让视频生成模型不再依赖昂贵 GPU 集群,做视频生成或分布式训练的团队可以关注这个开源方案,直接降低算力成本。原文稍后读已读值得跟进有用关注 视频生成
11:34IT之家(博客/媒体)76°小米汽车发布了全新的世界模型框架 Xiaomi Auto World Model,首次将三维重建与视频生成深度耦合,打破了行业长期将两者独立的技术路线。该框架通过重建提供几何锚点、生成填补未观测场景,实现了高稳定性、高一致性和高真实性,在 Waymo、nuScenes 等主流基准测试中全面取得 SOTA。目前该模型已在小米汽车的合成数据生成、仿真测试和智能座舱辅助驾驶学堂三大场景落地,交付了超过 10 万 clips 高质量合成数据。这一技术路径有望推动辅助驾驶从“场景感知”向“认知推演”的高阶形态跃迁。AI产品世界模型自动驾驶三维重建推荐理由:小米汽车把世界模型的两条路线拧成一股绳,解决了重建缺想象、生成易漂移的行业难题。做自动驾驶感知或仿真的团队,建议看看他们的论文和技术主页,或许能启发新的技术路径。原文稍后读已读值得跟进有用关注 世界模型
11:47美团技术团队@美团技术团队美团开源了 LongCat-Video-Avatar 1.5,这是一款从 SOTA 迈向商业级应用的数字人视频模型。它在唇形同步、物理合理性、长视频稳定性、多人互动和高效推理上实现了全面提升,能稳定输出高质量内容。该模型解决了数字人视频在复杂商业场景中不自然、不稳定、成本高的问题,让数字人从实验室走向真实应用。开源版本可供开发者直接使用,推动数字人视频生成技术的普及。AI模型数字人视频生成开源/仓库推荐理由:做数字人视频生成或虚拟主播的团队,终于有了一个能直接商用的开源模型——唇形同步和长视频稳定性提升明显,建议试试 LongCat 1.5 来降低制作成本。原文稍后读已读值得跟进有用关注 数字人
16:36官方账号阿里云 Alibaba Cloud@alibaba_cloud5月26日,Picsart视频产品主管Narek Hayrapetyan将在新加坡金沙会展中心分享多模态AI如何彻底改变视觉创作。活动由阿里云主办,聚焦AI在图像和视频生成中的实际应用。参与者可现场了解多模态模型如何提升创作效率。行业多模态视频生成大模型推荐理由:听Picsart高管讲多模态创作原文稍后读已读值得跟进有用关注 多模态
04:21官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 推出 LongLive-2.0,支持生成 720p 分辨率的长视频。该模型在多镜头序列中保持主体和背景一致性,并能在视频分块边界处切换提示词。相比前代,LongLive-2.0 在长视频连贯性和用户控制性上有所提升。AI模型LongLive-2.0NVIDIA视频生成2 个信源在谈事件专题推荐理由:NVIDIA 新模型能生成长视频还保持一致性原文稍后读已读值得跟进有用关注 LongLive-2.0
14:37IT之家(博客/媒体)76°美团技术团队正式开源了数字人视频生成模型 LongCat-Video-Avatar 1.5,该版本在唇形同步、物理合理性、长视频稳定性、多人互动及推理效率方面全面升级。模型采用 DMD 蒸馏技术,将生成步数从 50 步压缩至 8 步,推理效率提升约 15 倍,生成 10 秒视频仅需约 1 分钟。在用户偏好对比中,该模型相比 Kling Avatar 2.0 胜率为 65.9%,相比 OmniHuman-1.5 胜率为 61.1%,相比 HeyGen 胜率为 54.3%。美团表示,数字人视频生成正从展示效果走向真实使用,希望开源能成为可验证、可改进、可共建的技术基座。AI模型数字人视频生成开源/仓库推荐理由:数字人视频生成终于从演示走向了可商用——10 秒视频 1 分钟生成,效率提升 15 倍,做虚拟主播、在线教育、客服视频的团队可以直接拿来用,省去大量渲染时间。原文稍后读已读值得跟进有用关注 数字人
12:29官方一手pandaily@contact@pandaily.com (Pandaily)oiioii 是一个新兴的视频生成平台,提供超过 150 种视频动画风格,旨在满足创作者对特定艺术风格的控制需求。该平台在视频智能体时代推出,强调风格多样性和定制化,帮助用户从文本或图像生成具有独特视觉效果的视频。这一举措反映了 AI 视频生成领域从通用模型向专业化、风格化方向发展的趋势。AI产品视频生成动画风格创作者工具推荐理由:对于追求视频艺术风格多样性的创作者,oiioii 提供了超过 150 种动画风格,解决了通用模型风格单一的问题。做短视频、广告或动画的团队可以直接尝试,找到适合项目的独特视觉语言。原文稍后读已读值得跟进有用关注 视频生成
07:53AI Will@FinanceYF5Google 发布了名为 Gemini Omni 的新模型,能够从任意输入(如视频)生成任意内容。该模型首先支持视频输入,类似“Nano Banana”但针对视频场景。目前已在 Gemini App、Flow 和 YouTube 中可用,API 支持即将推出。这标志着多模态 AI 能力的重大扩展,让用户能更灵活地创作和交互。AI模型Gemini Omni多模态视频生成推荐理由:多模态 AI 又进一步——Gemini Omni 从视频直接生成内容,做视频创作或内容生产的团队值得关注,API 开放后可以直接集成到工作流中。原文稍后读已读值得跟进有用关注 Gemini Omni
02:34官方账号Runway ML@runwayml精选Runway推出Aleph 2.0版本,新增单帧编辑功能。用户可以在视频中编辑某一帧,预览更改效果,然后Aleph 2.0自动将该编辑传播到整个视频。该功能已在新的Edit Studio网页版上线。AI产品RunwayAleph视频编辑推荐理由:Runway的Aleph 2.0能让你改一帧全片跟着变原文稍后读已读值得跟进有用关注 Runway
15:20AI Will@FinanceYF5Google 发布了全新模型 Gemini Omni,能够根据任意输入(如文本、图像、音频)生成任意输出内容,首先支持视频生成。该功能将集成到 Gemini App、Flow 和 YouTube 中,API 支持即将推出。Omni 被视为“Nano Banana”的视频版,标志着多模态生成能力的重大突破。这一进展将极大简化内容创作流程,尤其对视频创作者和开发者意义重大。AI产品Gemini Omni多模态生成视频生成推荐理由:多模态生成从文本扩展到视频,做内容创作或视频开发的团队可以直接在 Gemini App 和 YouTube 中体验,建议第一时间试用。原文稍后读已读值得跟进有用关注 Gemini Omni
15:14官方一手marktechpost@Asif Razzaq精选字节跳动智能创作实验室推出Lance,一个原生统一多模态模型,仅用3B激活参数即可处理图像与视频的理解、生成和编辑。Lance在图像理解基准MSCOCO上达到44.8的BLEU-4,在视频生成测试集UCF-101上取得FVD 159.3。该模型支持文本到图像、文本到视频、图像编辑、视频编辑等多种任务。Lance以Apache 2.0许可证开源,代码和权重已在GitHub发布。AI模型LanceByteDance多模态推荐理由:3B参数打通图视频理解生成原文稍后读已读值得跟进有用关注 Lance
11:41官方账号快手可灵 Kling@Kling_AIKling AI 在戛纳电影节上展示了其参与的全 AI 生成电影项目 RAPHAEL。该片由 Mateo AI Studio 与韩国 MBC C&I 的 AI 内容实验室合作开发,计划于 2026 年院线上映。项目全程使用 Kling AI 的视频模型来生成独特视觉效果,旨在证明纯 AI 电影制作的工业可行性,并推动 AI 原生影院电影的新趋势。AI产品Kling AIAI 电影视频生成推荐理由:这是 AI 视频生成从短片走向长片院线电影的关键一步,做影视制作、AI 内容创作的团队值得关注——它展示了 AI 工具在工业级项目中的实际落地能力。原文稍后读已读值得跟进有用关注 Kling AI
08:01官方账号Andrew Ng@AndrewYNgAndrew Ng 宣布与 Google Cloud 合作推出新课程,教授如何构建能生成图像和视频的 AI 智能体。课程重点在于让智能体自我评估输出并迭代改进质量,涵盖三种评估技术:图像-文本相似度评分、LLM 裁判按品牌一致性等自定义标准评分、以及结构化评分表。学员将学习图像和视频提示工程,构建将品牌指南转化为 UI 模型的图像智能体,以及规划多场景解说视频并同步音频的视频智能体。该课程面向希望探索 AI 智能体在视觉内容生成领域应用的开发者。AI产品智能体图像生成视频生成推荐理由:Andrew Ng 的课程一向实用,这次聚焦图像/视频生成智能体这个少有人深入的方向,做多模态或内容生成的开发者可以直接学起来,掌握让智能体自我迭代的关键技巧。原文稍后读已读值得跟进有用关注 智能体
08:00Google Gemini App@GeminiAppGoogle 的 Gemini Omni 功能允许用户创建个人数字分身(avatar),该分身能复制用户的声音和形象。用户只需一次创建,之后即可反复使用该分身生成视频,无需每次重新上传照片或录制音频。这一功能极大简化了视频制作流程,尤其适合需要频繁出镜的内容创作者、教育工作者或企业培训场景。目前该功能已通过 Gemini App 推出,引发广泛关注。AI产品Gemini Omni数字分身视频生成推荐理由:做视频内容的人终于不用每次重新录制了——Gemini Omni 的数字分身让你一次创建、反复使用,省去大量重复工作,建议内容创作者和培训团队试试。原文稍后读已读值得跟进有用关注 Gemini Omni
08:00HeyGen@HeyGen_Official83°HeyGen 发布了其最高质量的 AI 虚拟形象模型 Avatar V API,定价为每秒 0.05 美元。该模型在跨场景说话头像生成任务中,与 Veo 3.1、Kling O3 Pro、OmniHuman 1.5 和 Seedance 2.0 进行了基准测试,并在所有类别中胜出。HeyGen 同时发布了研究论文和 API 接口,供开发者直接使用。这标志着 AI 虚拟形象生成在质量和成本上迈出了重要一步,尤其适合需要高保真数字人视频的应用场景。AI产品虚拟形象API数字人推荐理由:HeyGen 的 Avatar V 在跨场景说话头像生成上全面领先竞品,做数字人、虚拟主播或视频生成的开发者可以直接用 API 接入,成本可控且效果顶级。原文稍后读已读值得跟进有用关注 虚拟形象
08:00Sundar Pichai@sundarpichai83°Google CEO Sundar Pichai 宣布推出 Gemini Omni,这是一个不仅能生成逼真场景,还能推理下一步该发生什么的视频生成模型。它结合了物理直觉与 Gemini 对历史、科学和文化背景的知识,使生成的视频更具逻辑性和上下文相关性。该功能今日起面向全球 Google AI Plus、Pro 和 Ultra 订阅用户,通过 Gemini 应用、Google Flow 以及 YouTube Shorts 逐步开放。这一进展标志着 AI 视频生成从“看起来真实”向“理解并预测动态”迈出了重要一步。AI产品Gemini Omni视频生成物理推理推荐理由:做视频生成或 AI 内容创作的团队,终于有了一个能理解物理规律和文化背景的模型——生成的视频不再只是视觉逼真,而是逻辑连贯。建议订阅 Google AI 的用户立即体验。原文稍后读已读值得跟进有用关注 Gemini Omni
07:59官方一手歸藏(guizang.ai)@op7418藏师傅已完成一个通过前端生成讲解视频的Skill,但希望优化效果、提高工程化并降低Token用量。他让Claude Code分析了一个40秒视频案例,发现总消耗145万Token,其中输入占比极高,输出仅占0.7%。视频组合和Skills消耗最大,但使用Claude Code时有92%缓存,实际成本可控。该方案结合了PPT Skill(美学、版式、动效)、HyperFrames(时间线、渲染、字幕)、Listenhub Skill(配音)和即梦CLI(演示和B-roll),展示了多工具协同的AI视频生成流程。AI产品Claude Code视频生成Token优化推荐理由:做AI视频生成或工程化优化的开发者,可以看看藏师傅如何用Claude Code分析Token消耗并针对性优化,直接复用他的缓存策略能省不少成本。原文稍后读已读值得跟进有用关注 Claude Code
11:53官方一手pandaily@contact@pandaily.com (Pandaily)72°字节跳动(TikTok母公司)即将推出其AI视频生成模型Seedance 2.1版本,据称质量提升20%。该模型在视频生成领域进一步优化,旨在提升生成视频的逼真度和流畅性。此次更新可能加强字节跳动在AI视频生成赛道的竞争力,与OpenAI的Sora等产品展开竞争。Seedance 2.1的发布预计将吸引内容创作者和视频制作团队的关注。AI模型视频生成Seedance字节跳动9 个信源在谈事件专题推荐理由:视频生成质量提升20%意味着更逼真的AI视频,做短视频或内容创作的团队可以直接关注,看看能否替代现有工具。原文稍后读已读值得跟进有用关注 视频生成
09:52shao__meng@shao__meng83°Google 在 I/O 大会上发布了 Gemini Omni,这是一个原生多模态的「理解+生成」模型,主攻视频领域。与 Veo、Sora 等传统视频生成模型不同,Omni 从底层设计为多模态,支持任意组合输入(图、文、视频、音频)产出或编辑视频。其核心差异化能力包括对话式视频编辑(多轮修改保持一致性)、结合世界知识与物理直觉的生成,以及任意参考物组合。Omni 在编辑方式、提示词要求和知识运用上全面超越现有模型,标志着视频生成进入新阶段。AI产品Gemini Omni多模态模型视频生成推荐理由:做视频创作或 AI 内容生成的团队,终于有了一个能像聊天一样改视频的工具——多轮编辑保持一致性,不用每次重写 prompt,建议直接看官方对比。原文稍后读已读值得跟进有用关注 Gemini Omni
08:18berryxia@berryxia76°Google 发布 Gemini Omni,一种不仅能生成逼真视频,还能基于物理直觉和知识推理场景后续发展的 AI 模型。它将物理直观与历史、科学、文化背景知识结合,使生成内容更符合现实逻辑。该模型即日起面向全球 Google AI Plus、Pro 和 Ultra 订阅用户推出,首批支持视频输出。这一进展标志着视频生成从单纯视觉真实迈向因果推理的新阶段。AI模型Gemini Omni视频生成物理推理推荐理由:做视频生成或物理模拟的开发者值得关注——Gemini Omni 把常识推理带进视频生成,让 AI 不再只是“画得好”,而是“想得对”。原文稍后读已读值得跟进有用关注 Gemini Omni
06:03rohanpaul_ai@rohanpaul_ai83°Google 推出 Gemini Omni,一个能从视频、图像、音频、文本和草图等多种输入生成并编辑视频的 AI 模型。用户只需用自然语言描述,即可添加角色、替换物体、改变动作、调整风格、同步声音或移动镜头,且每次编辑后场景保持稳定。Omni 具备更强的世界理解能力,能更真实地模拟重力、流体运动、动能和物理交互。该模型将集成到 Gemini 应用、Google Flow 和 YouTube Shorts 中。Google 还为 Omni 输出添加了 SynthID 水印和 C2PA 内容凭证,以标识 AI 生成或编辑的媒体。AI产品Gemini Omni视频生成视频编辑2 个信源在谈事件专题推荐理由:视频创作者和内容团队终于有了一个能像导演一样反复指导修改的 AI 工具,而非一次性的 prompt 生成。做短视频、广告或影视后期的人,可以直接用自然语言调整画面细节,值得关注。原文稍后读已读值得跟进有用关注 Gemini Omni
03:31官方账号NVIDIA AI@NVIDIAAI76°NVIDIA 研究团队开源了 SANA-WM,一个 2.6B 参数的世界模型,能在单张 GPU 上根据一张图片、文本描述和相机轨迹生成 60 秒可控视频。该模型原生支持精确的相机控制,为视频生成和世界模拟提供了新的可能性。SANA-WM 的开源发布降低了高质量可控视频生成的门槛,对内容创作、游戏和仿真领域有重要意义。AI模型世界模型视频生成相机控制2 个信源在谈事件专题推荐理由:NVIDIA 把世界模型的门槛拉到单卡可跑,做视频生成或 3D 仿真的开发者可以直接拿来用,60 秒可控视频不再是云端专属。原文稍后读已读值得跟进有用关注 世界模型
03:17官方账号Google AI@GoogleAI精选GoogleAI 推出 Gemini Omni 模型,支持从文本、图像、音频等多种输入类型生成内容,初始阶段重点支持视频输入。该模型旨在实现“从任何输入创建任何输出”的目标,但官方未公布具体基准测试成绩或模型参数。推文通过 Twitter 线程形式解释其意义,引发社区关注。AI模型Gemini OmniGoogleAI多模态推荐理由:谷歌的万能创作模型来了原文稍后读已读值得跟进有用关注 Gemini Omni
03:07Google Gemini App@GeminiApp精选Google在Google IO上发布新模型Gemini Omni,可接受图像、视频和文本作为输入,生成高质量视频。该模型利用Gemini的真实世界知识,使视频内容更加准确和连贯。这是多模态视频生成的重要进展,支持从多种混合输入直接创建视频内容。AI模型Gemini OmniGoogle视频生成推荐理由:Google发了能多模态生视频的模型原文稍后读已读值得跟进有用关注 Gemini Omni
01:23官方账号Logan Kilpatrick@OfficialLoganK精选Google 发布新模型 Gemini Omni,支持从文本、图像等任意输入生成视频,类似 Nano Banana 能力。当前可在 Gemini App、Flow 和 YouTube 中使用。API 支持即将推出。AI模型GeminiOmniGoogle推荐理由:Gemini能直接生成视频了原文稍后读已读值得跟进有用关注 Gemini
01:17官方账号Google DeepMind@GoogleDeepMindGoogle DeepMind推出Gemini Omni,这是其首个可从任何内容生成任何内容的模型,首先聚焦视频生成。该模型结合了Gemini的推理能力与DeepMind的生成式媒体系统,在多模态理解和编辑方面取得进展。它代表了世界理解、多模态和编辑能力的飞跃。目前已开始部署。AI模型Gemini OmniGoogle DeepMind多模态推荐理由:谷歌发布能生成视频的Gemini Omni原文稍后读已读值得跟进有用关注 Gemini Omni
00:47berryxia@berryxia88°NVIDIA研究员Yukang Chen开源了LongLive 2.0,这是全球首个端到端支持4-bit量化的超长视频生成基础设施,覆盖训练和推理全流程。核心技术包括FP4量化和并行加速,在5B模型上实现45.7 FPS的实时生成速度。该工具支持真实视频训练、few-step蒸馏、多shot训练/推理、序列并行、NVFP4 KV cache和异步VAE解码部署。此前长视频生成面临速度慢或长度受限的问题,LongLive 2.0将4-bit长视频实时生成能力推向开源社区。AI产品NVIDIALongLive 2.04-bit量化2 个信源在谈事件专题推荐理由:做视频生成或AI基础设施的开发者终于有了一个能跑长视频的4-bit开源方案,NVIDIA把训练到推理的整套加速打法打包好了,建议直接试代码。原文稍后读已读值得跟进有用关注 NVIDIA
23:48AK@_akhaliq精选Nvidia 推出 LongLive-2.0,基于 NVFP4 并行架构,专门用于长视频生成。该基础设施旨在解决长时序视频生成的计算瓶颈,提升生成效率。与以往方案相比,LongLive-2.0 能够处理更长时间的视频序列。AI产品NvidiaLongLive-2.0NVFP44 个信源在谈事件专题推荐理由:Nvidia 开源长视频生成框架原文稍后读已读值得跟进有用关注 Nvidia
23:38TestingCatalog@testingcatalogGoogle 在 I/O 大会上宣布 Google Flow 新增角色和场景功能,用户可以创建可复用的角色用于视频生成,并支持多种角色语音。此外,Google Flow 的 Android 应用已上架 Google Play。这些更新使视频创作更灵活高效,适合内容创作者和开发者测试使用。AI产品Google Flow视频生成角色推荐理由:做视频创作的团队终于有了可复用的角色和场景功能,还能选不同语音,Android 用户可以直接下载体验,建议试试。原文稍后读已读值得跟进有用关注 Google Flow
14:21官方账号阿里云 Alibaba Cloud@alibaba_cloud阿里云宣布成为2026年摩纳哥AI电影节的冠名赞助商,该电影节是电影与人工智能交汇的盛会。作为云计算和AI基础设施的全球领导者,阿里云将为创作者、工作室和创新者提供训练大模型、生成沉浸式视频内容以及高性能渲染等工具。电影节将于2026年6月9日至10日在摩纳哥蒙特卡洛举行,旨在支持新一代AI驱动的创意制作。此举标志着阿里云在AI创意领域的重要布局,推动技术与艺术的融合。行业阿里云AI电影节云计算推荐理由:阿里云冠名AI电影节,说明云厂商正在认真押注AI创意工具赛道——做视频生成、影视渲染的团队可以关注其提供的底层基础设施,看看能否降低自己的制作成本。原文稍后读已读值得跟进有用关注 阿里云
12:35OpenRouter@OpenRouterAIOpenRouter 发布了新的 Playground 侧边栏,能够根据用户尝试的模型类型自动调整界面,提供更直观的操作体验。该功能目前支持 @Kling_ai 的 Video v3 模型,用户可以直接在侧边栏中预览视频生成效果。这一更新降低了多模型切换时的学习成本,让开发者或创作者能更快上手不同模型。目前该功能已在 OpenRouter 平台上可用。AI产品OpenRouterPlayground模型切换推荐理由:OpenRouter 这个侧边栏解决了多模型切换时界面不统一的问题,做 AI 应用开发或内容创作的团队可以直接用,省去反复适应不同模型 UI 的时间。原文稍后读已读值得跟进有用关注 OpenRouter
12:10OpenRouter@OpenRouterAIxAI 的 Grok 创意套件新增三个模型,已在 OpenRouter 平台上线。Grok Imagine Image Quality 支持照片级图像生成与编辑;Grok Imagine Video 可从文本、图像或参考素材生成短视频;Grok Voice TTS 1.0 提供 5 种语音、覆盖 20 多种语言。这些模型扩展了 Grok 在图像、视频和语音合成方面的能力,为开发者和创作者提供了更多选择。AI产品Grok图像生成视频生成推荐理由:xAI 一口气推出图像、视频、语音三款模型,做内容创作或 AI 应用的开发者可以直接在 OpenRouter 上调用,省去部署成本,建议试试。原文稍后读已读值得跟进有用关注 Grok
20:10官方一手歸藏(guizang.ai)@op7418开发者基于藏师傅的PPT Skill,结合Codex和远程控制,实现了低成本的讲解视频自动生成。视频内容主要用前端生成,配音和部分分镜使用音频和Seedance 2.0模型。该组合还能在聊天中直接预览视频,配合即梦CLI补充真实片段,适合产品更新介绍等场景。这大幅降低了视频制作门槛,让不在家的用户也能一键产出可用性高的内容。AI产品视频生成PPT SkillCodex推荐理由:做产品更新或教程视频的团队,可以用这个组合低成本批量产出内容,远程一键搞定,建议试试。原文稍后读已读值得跟进有用关注 视频生成
13:28IT之家(博客/媒体)精选陆军政治工作部宣传局联合中央广播电视总台军事节目中心,运用AI技术制作系列微短剧《战魂》,今日首播。该剧共5集,每集讲述一支英模连队的故事,还原经典战役战斗。首集《大渡河连》再现十七勇士强渡大渡河的历史场景。CCTV-7国防军事频道和央视军事每日播出一集,持续5天。去年九三阅兵前,中国军号曾发布AI生成李云龙与李幼斌跨时空对话视频。AI产品战魂AI微短剧视频生成推荐理由:AI还原经典战役原文稍后读已读值得跟进有用关注 战魂