20:14量子位@量子位的朋友们万兴科技在WAIC 2026上展示了万兴剧厂的“无限画布”功能,该功能支持超大尺寸视频创作。同时首秀了Filmora.AI,集成AI剪辑与生成能力。另一款新品Virbo AI专注于数字人形象生成与驱动。三款产品均面向AI视频创作场景。AI产品万兴剧厂无限画布Filmora.AI推荐理由:万兴把三个AI视频工具都带到WAIC了,无限画布做大片、Filmora.AI剪视频、Virbo AI做数字人,想玩AI视频的可以看看。原文稍后读已读值得跟进有用关注 万兴剧厂
14:03Ate-a-Pi@svpino当前AI视频生成平台主要依赖提示词写作,限制了创作自由度。TapNow Creative OS提供了一种AI原生创意系统,允许用户创建简报、参考图像、生成片段并直接用于项目管理。该系统可用于广告活动提案、产品发布或团队协作反馈管理。这些功能让视频制作更灵活高效。AI产品TapNow Creative OS视频生成AI原生创意系统推荐理由:TapNow Creative OS让你摆脱纯提示词,用简报、图像参考和片段拼接来制作视频,比现有视频工具更灵活好用。原文稍后读已读值得跟进有用关注 TapNow Creative OS
09:45SuperTechFans(博客/媒体)79°Claude Fable 5和GPT-5.6 Sol在100美元预算下各自制作Bruno Mars《Uptown Funk》音乐视频。Claude花费$48.60生成1920x1080视频,GPT花费$36.57并混合使用多个视频模型。两者作品可用但故事一致性差、对歌词理解过于字面。Claude的LLM token成本$16.99-$25.05,占总成本30-40%,远高于GPT的$3-4。AI模型Claude Fable 5GPT-5.6 Sol视频生成10 个信源在谈事件专题推荐理由:想看看两个顶级AI花100美元能做出什么视频?实验显示Claude Fable 5和GPT-5.6 Sol的作品都还行但不惊艳,而且Claude的token成本比GPT高出好几倍。原文稍后读已读值得跟进有用关注 Claude Fable 5
05:16官方账号Runway ML@runwaymlRunway 发布技术博文《Engineering Runway Agent》,披露其智能体产品的设计思路与工程实践。文章讨论了 Agent 如何结合视频生成能力实现自动化工作流。团队介绍了系统架构、多模态交互方式以及性能优化策略。该博文旨在为开发者提供构建 AI 代理的参考经验。技巧RunwayRunway Agent智能体推荐理由:Runway 分享了怎么造一个能自动剪视频的 Agent,搞视频生成和智能体开发的朋友可以看看他们的技术路线。原文稍后读已读值得跟进有用关注 Runway
05:15官方账号Runway ML@runwayml独立人类评估对六款AI视频智能体进行了30个电影提示和16个指标的测试。Runway Agent 2.0 在叙事连贯性、电影语言和制作质量三大支柱上均排名第一。Physion Labs 发布的 Physion-Arc 1.0 基准测试了100个剧本和600个生成视频,Runway 在主观指标(如电影品味)上优势尤其明显。AI模型Runway AgentPhysion-Arc视频生成推荐理由:Runway Agent 2.0 在视频生成评测里全面碾压了 Luma、MiniMax 这些对手,叙事和电影感都拿第一,做视频的可以看看。原文稍后读已读值得跟进有用关注 Runway Agent
21:43@koltregaskes@koltregaskes资深制片人Jonathan Yunger(曾参与《敢死队》《Rambo》系列)首次看到机器而非团队组装的电影时感到悲凉。他联合Hank Hoffman创立Arcana Labs,开发生成式工具以压缩迭代与协调成本。其短片Echo Hunter采用真实演员动作捕捉,由AI完成视觉特效,成本低于5万美元,获SAG-AFTRA批准,YouTube近50万观看。Yunger主张艺术家驱动的AI,目标是为无法获得投资的原创故事开辟资金渠道。行业Arcana LabsEcho HunterAI电影制作推荐理由:老牌制片人用AI把电影成本压到5万美元,短片Echo Hunter在YouTube快50万播放了,不是取代演员,是帮新导演省钱拍原创。原文稍后读已读值得跟进有用关注 Arcana Labs
13:46IT之家(博客/媒体)谷歌在 Google Vids 中推出数字分身功能,用户上传一张自拍照和一段语音录音即可生成外貌和声音模仿本人的虚拟形象。多模态 AI 模型 Gemini Omni 也登陆该平台,支持文字提示词和参考图片生成视频,并可更换背景、改善光线或加入特效。Omni 还支持分步编辑,无需重新生成整段视频。数字分身绑定谷歌账号并嵌入 SynthID 隐形水印,仅面向部分国家年满18岁的用户开放。AI产品Google VidsGemini Omni数字分身1 个信源在谈事件专题推荐理由:谷歌给 Vids 加了数字分身,上传自拍和录音就能生成自己出镜的 AI 视频,还能用 Gemini Omni 改背景调光线,比 HeyGen 更方便。原文稍后读已读值得跟进有用关注 Google Vids
11:58官方账号arXiv cs.LG@Yushi Huang, Xiangxin Zhou, Jun Zhang, Liefeng Bo, Tianyu PangMeanFlowNFT是一种新方法,将前向过程强化学习(RL)框架DiffusionNFT扩展到平均速度生成器(MeanFlow)。它利用MeanFlow身份构建瞬时速度预测器,在保持平均速度采样(实现快速少步生成)的同时进行奖励优化。实验在图像和视频生成上证明,MeanFlowNFT在SD3.5-M的8项指标中提升6项,优于先前最先进的少步RL生成器。在Wan 2.1视频模型上,4步MeanFlowNFT达到VBench 84.33分,超过50步LongCat-Video RL的82.57分。AI模型MeanFlowNFTDiffusionNFT强化学习推荐理由:MeanFlowNFT让平均速度生成器也能用上强化学习,4步生成效果比50步的RL模型还好,值得试。原文稍后读已读值得跟进有用关注 MeanFlowNFT
02:39techcrunch@Sarah PerezGoogle Vids 推出个性化 AI 头像,用户可创建数字版自己并用于视频制作。该功能由 Gemini Omni 驱动,支持通过文本提示和参考图像生成及编辑视频。用户无需专业设备即可生成包含本人形象的 AI 视频。此更新目前面向部分 Workspace 用户开放。AI产品Google VidsGemini Omni视频生成1 个信源在谈事件专题推荐理由:Google 在 Vids 里加了 AI 头像,你用自己的照片就能生成数字分身,配合 Gemini Omni 还能从文字直接做视频,适合快速做个人介绍或创意短片。原文稍后读已读值得跟进有用关注 Google Vids
16:24官方一手pandaily@contact@pandaily.com (Pandaily)Moonshot AI的Kimi K3模型在Arena基准测试中亮相,用户测试显示其视频生成细节和动画流畅度接近Fable 5水平。该模型在社交媒体上引发大量评测视频。Kimi K3是目前Moonshot AI的最新视频生成模型,性能对标行业领先的Fable 5。AI模型Kimi K3Moonshot AI视频生成10 个信源在谈事件专题推荐理由:Moonshot AI的Kimi K3在视频生成上直追Fable 5,细节和流畅度都很惊艳,而且是国产模型,值得关注。原文稍后读已读值得跟进有用关注 Kimi K3
01:16Justine Moore@venturetwinsBytePlus 展示其最新 AI 视频生成模型 Seedance 2.5,用其重现已退役足球明星 Michael Owen 职业生涯的经典时刻。该模型能生成高质量、连贯的视频片段,几乎可用于所有常见视频创作场景。如果公开版本保持同样水准,AI 生成视频将在更多实际用例中取代传统制作。AI模型Seedance 2.5BytePlus视频生成推荐理由:BytePlus 的 Seedance 2.5 把 AI 视频生成又推了一大步,连足球名将的巅峰动作都能还原,效果非常逼真。原文稍后读已读值得跟进有用关注 Seedance 2.5
17:54Hailuo AI@Hailuo_AIMiniMax 将在上海 WAIC 2026 上设立展位,日期为 7 月 17 日至 20 日。参与者可参加动手工作坊和专家小组讨论。展会将展示端到端 AI 创意工作流。现场还有定制周边礼品可领取。行业MiniMaxHailuoWAIC2026推荐理由:MiniMax 在 WAIC 2026 搞了个展位,能上手玩他们的 AI 工作流,还有专家聊行业趋势,顺便薅点周边。原文稍后读已读值得跟进有用关注 MiniMax
08:03berryxia@berryxia73°阿里巴巴开源了Wan-Dancer-14B模型,这是一个14B参数的模型,可以根据音乐生成与节拍同步的舞蹈视频。该模型支持街舞、踢踏、拉丁、K-Pop、中式古典等多种舞蹈风格,并能实现较长时间连贯输出。用户可在本地运行该模型,不再依赖云端服务,大幅降低了音乐驱动舞蹈生成的门槛。此前类似能力多依赖闭源模型或效果不佳,此次开源权重让本地部署成为现实。AI模型Wan-Dancer-14BAlibaba视频生成推荐理由:阿里开源了Wan-Dancer-14B,能根据音乐生成同步舞蹈视频,支持多种风格,本地就能跑,比闭源模型门槛低得多。原文稍后读已读值得跟进有用关注 Wan-Dancer-14B
01:49Justine Moore@venturetwinsSeedance 2 模型通过单次生成(one-shot)输出一段仿2000年代早期DV摄像机风格的庞贝古城纪录片片段,模拟维苏威火山喷发瞬间。提示词描述了从日常景象到人群恐慌的完整叙事,包含自然摇晃、对焦失误、曝光问题等瑕疵。该演示展示了AI在历史事件想象场景中的高保真度与可控性。AI模型Seedance 2视频生成历史事件推荐理由:Seedance 2 能根据一条提示词直接生成纪录片质感的庞贝火山爆发视频,连旧DV的抖动和曝光错误都模拟了,很逼真。原文稍后读已读值得跟进有用关注 Seedance 2
00:43elvis@omarsar0精选大多数世界模型在几秒后出现纹理涂抹、几何扭曲等失败模式。LingBot-World 2.0来自@robbyant_brain,在720p分辨率下以60fps保持互动长达一小时。该模型解决了长期视频生成中的一致性难题。其架构创新使得长时间高保真世界模拟成为可能。AI模型LingBot-World 2.0世界模型视频生成推荐理由:别的世界模型几秒就崩,LingBot-World 2.0能稳跑一小时720p 60fps,超实用。来看看它怎么做到的。原文稍后读已读值得跟进有用关注 LingBot-World 2.0
23:45官方账号Runway ML@runwaymlRunway发布了Agent工具,可用于创作电影短片。官方展示了类似Flicker的短片示例,强调无需大预算或工作室干预。用户可以通过简单步骤将创意转化为视频。该工具降低了电影制作门槛,让个人创作者也能生成高质量短片。技巧RunwayAgent文本到视频推荐理由:Runway出了个Agent,直接教你怎么用它做短片,连Flicker那种效果都能复现,不用烧钱。原文稍后读已读值得跟进有用关注 Runway
19:27官方账号Decoder@Jonathan KemperAI视频生成初创公司PixVerse在完成C轮扩展融资后估值超过20亿美元。这家新加坡公司的最新融资表明投资者仍然看好AI视频生成领域。PixVerse与Runway、Pika等竞争者一起参与视频生成市场。行业PixVerse视频生成融资推荐理由:PixVerse融了C轮估值冲到20亿,说明视频生成这赛道还没卷到头,有空间再跑出一个赢家。原文稍后读已读值得跟进有用关注 PixVerse
12:43量子位@梦瑶某团队发布了视频Agent产品,内置超过100个导演级技能,用户可随时调用。该Agent能够辅助视频创作全流程,从分镜到剪辑提供专家级建议。这是首个达到可用级别的视频Agent产品,标志着AI视频生成进入实用阶段。AI产品视频Agent100+Skill视频生成推荐理由:有个视频Agent产品,集成了100多个导演级技能,能直接帮你做视频创作,随叫随到,很实用。原文稍后读已读值得跟进有用关注 视频Agent
12:42量子位@量子位的朋友们高德推出通用世界模型工坊ABot-World Studio,可基于单张5090显卡生成小时级实时交互式视频与3D场景。该工坊支持用户通过输入文本或图像直接创建可交互的3D世界,并实现实时渲染。其生成效率较传统方案提升显著,降低了大规模3D内容创作的门槛。模型已在高德地图内部多个场景进行测试,展示出良好的实用性。AI模型高德ABot-World Studio世界模型推荐理由:高德发了ABot-World Studio,用一张5090就能生成小时级的实时3D场景和交互视频,做游戏或数字孪生都可以试试,门槛低了很多。原文稍后读已读值得跟进有用关注 高德
06:23Ate-a-Pi@svpino76°LingBot-World-Infinity 是一个开权重世界模型,参数规模14B,另有1.3B变体可在单消费级GPU运行。该模型通过让自身在训练时主动进入错误状态,再学习如何恢复,从而生成长达1小时以上且跨场景连贯的视频,克服了传统逐帧模型误差累积的问题。论文详细描述了其自我纠错训练方法,并已公开GitHub仓库和模型权重。AI模型LingBot-World-Infinity视频生成开源模型推荐理由:开源权重模型,14B参数就能生成1小时连贯视频,还带1.3B小版本跑在单显卡上,长视频生成终于不崩了。原文稍后读已读值得跟进有用关注 LingBot-World-Infinity
23:18官方账号快手可灵 Kling@Kling_AIKling AI被用于制作葡萄牙世界杯宣传片,播放量接近1亿次。该片由78 Films采用Kling AI进行混合制作,在保持人类创意和情感的同时实现电影级画质。导演João Seiça表示AI用于拓展而非替代创造力。AI模型Kling AI视频生成78 Films推荐理由:Kling AI做的世界杯宣传片,播放快1亿了,画面跟电影一样,看看AI怎么帮人拍大片。原文稍后读已读值得跟进有用关注 Kling AI
15:30向阳乔木@vista8Codex 生成了一段产品介绍视频。视频中的文案和介绍部分清晰易懂。该视频展示了 Codex 在文案生成上的应用效果。AI产品Codex视频生成产品介绍推荐理由:Codex 生成的视频文案很清楚,想看看 AI 怎么做产品视频的可以点开。原文稍后读已读值得跟进有用关注 Codex
12:04向阳乔木@vista8ChatCut是一款AI剪辑工具,通过安装MCP和Skill插件即可在Codex中调用。安装时需进行OAuth授权,随后对话输入指令即可生成带配音的产品演示视频。教程演示了用ChatCut为指定网址制作图文并茂的功能视频,效果虽粗糙但比纯文字更生动。技巧ChatCutCodexMCP/工具推荐理由:ChatCut跟Codex搭起来用,输入网址就能生成带配音的产品视频,省去手动剪辑的麻烦。原文稍后读已读值得跟进有用关注 ChatCut
10:53官方账号阿里云 Alibaba Cloud@alibaba_cloud阿里云在新加坡举办的WAN AI视频挑战赛已结束,公布了获奖者名单。比赛历时数月,创作者使用WAN AI模型生成视频。该赛事旨在探索AI视频生成的可能性,合作伙伴和参赛者共同参与。行业阿里云WAN AI视频生成推荐理由:阿里云在新加坡办了个AI视频比赛,用WAN模型生成视频,挺有意思的,看看获奖作品吧。原文稍后读已读值得跟进有用关注 阿里云
09:50官方账号阿里云 Alibaba Cloud@alibaba_cloud在AI电影节摩纳哥黑客马拉松中,短片《Share it!》获得第10名。该片由Roger Delmont创作,使用阿里云Model Studio及HappyHorse 1.0模型生成。影片讲述一位小丑将内心痛苦转化为欢乐的故事,展现了AI视频生成在情感表达中的潜力。行业阿里云Model StudioHappyHorse 1.0AI电影节推荐理由:阿里云的HappyHorse 1.0在AI电影节拿了第10名,短片用Model Studio讲小丑的故事,很温情,可以看看AI怎么创作有深度的短片。原文稍后读已读值得跟进有用关注 阿里云Model Studio
09:49官方账号阿里云 Alibaba Cloud@alibaba_cloud在第9届摩纳哥AI电影节黑客马拉松中,作品《Between》获得第9名。该片由Davit Jijavadze创作,采用水彩动画风格,讲述一朵野花破开办公室地板唤醒主角的故事。短片使用了阿里云Model Studio和Happy Horse 1.0生成。这一成绩展示了AI视频生成工具在艺术创作中的潜力。AI模型Alibaba Cloud Model StudioHappy Horse 1.0AI Film Festival Monaco推荐理由:阿里云和Happy Horse 1.0合作做了一个水彩动画短片,在摩纳哥AI电影节黑客马拉松拿第9。故事很走心,技术也酷,值得看看。原文稍后读已读值得跟进有用关注 Alibaba Cloud Model Studio
09:45官方账号阿里云 Alibaba Cloud@alibaba_cloud在摩纳哥AI电影节黑客马拉松中,短片《Tethered》由导演Luke Asco创作并获第七名。该片使用阿里云的Happy Horse和Happy Oyster工具,结合实景表演与AI世界构建。故事讲述两名宇航员在太空边缘共享幻觉的体验。作品展示了生成式AI在电影叙事中的新可能性。行业阿里云Happy HorseHappy Oyster推荐理由:阿里云用Happy Horse和Happy Oyster做了个AI短片,在摩纳哥AI电影节黑客马拉松拿了第七,把实景和AI场景混在一起拍科幻片,很有意思。原文稍后读已读值得跟进有用关注 阿里云
09:44官方账号阿里云 Alibaba Cloud@alibaba_cloud在AI电影节摩纳哥黑客马拉松中,短片《The Hero I Drew》获得第六名。该片由Denys Blizhnikov制作,讲述一个男孩画的武士活过来引导他找到勇气的故事。该片使用了阿里云Model Studio和HappyHorse 1.0进行创作。HappyHorse是阿里云推出的创意引擎,支持视频生成。行业HappyHorseAlibaba CloudModel Studio推荐理由:阿里云用HappyHorse 1.0做的短片拿了AI电影节第六名,画面很诗意,想看看创意工具怎么用的可以戳。原文稍后读已读值得跟进有用关注 HappyHorse
12:55Ate-a-Pi@svpino未来的AI视频生成将走向交互式直播体验,类似《少数派报告》中的广告屏系统。这种实时交互性比静态视频更能吸引观众。开发者展示的demo已展现出这种潜力,链接见引用推文。行业视频生成交互式直播Minority Report推荐理由:一位开发者演示了AI视频的交互式直播demo,就像《少数派报告》里的广告屏一样酷。未来视频不再是静态的,而是实时回应观众。原文稍后读已读值得跟进有用关注 视频生成
23:30Hailuo AI@Hailuo_AIMiniMax旗下HailuoAI发布了一部题为《Butterfly Beyond Code》的短片,由Cat Jin执导,Yi Zhongtia监制。短片援引庄子哲学,探讨技术抹杀个体性后自我本质的问题。截至发布时,该推文获得961次浏览和10个点赞。AI产品MiniMaxHailuoAIButterfly Beyond Code推荐理由:MiniMax拍了个哲学短片,借用庄子思想探讨AI个体性,有点意思,可以看看。原文稍后读已读值得跟进有用关注 MiniMax
23:52AK@_akhaliqOPSD-V是一种用于后训练阶段的自蒸馏技术,专门优化自回归视频生成器的少步生成能力。该方法通过在线策略蒸馏,让模型在仅几步推理内达到与多步推理相近的视频质量。论文展示了OPSD-V在多个视频生成基准上提升了生成效率同时保持视觉保真度。论文OPSD-V自蒸馏视频生成推荐理由:想用更少的生成步骤做出高质量视频?这篇讲OPSD-V方法,用自蒸馏让视频生成器几步就够。原文稍后读已读值得跟进有用关注 OPSD-V
15:49官方一手歸藏(guizang.ai)@op7418Kaze AI 推出了名为 Kaze AI Agent 的视频图像智能体,专攻广告内容生成。该 Agent 能处理社交帖子、产品摄影、视频广告和电影叙事等创意任务。用户无需频繁提示即可规模化生产内容,号称提升 10 倍创意效率和 100 倍生产力。广告主可依据清晰的 ROI 计算决定投放预算。AI产品Kaze AI视频生成广告内容推荐理由:Kaze AI 的新 Agent 专做广告视频和图像,效率拉满10倍,广告主投钱好算ROI,值得一试。原文稍后读已读值得跟进有用关注 Kaze AI
12:43官方一手marktechpost@Asif Razzaq精选蚂蚁集团Robbyant团队发布LingBot-World-Infinity(LingBot-World 2.0),一个14B参数因果视频生成模型,用作交互式世界模拟器。核心创新包括混合双向自回归(MoBA)注意力机制和分布匹配蒸馏,解决长程漂移导致的纹理模糊和几何变形。报告展示单个60分钟不间断会话涵盖20个场景。但发布内容仅包含一个检查点、480P参考脚本,无部署代码和定量基准,且采用非商业许可CC BY-NC-SA 4.0。AI模型LingBot-World-InfinityRobbyant蚂蚁集团推荐理由:蚂蚁发了14B的世界模型LingBot-World-Infinity,能生成60分钟视频模拟20个场景,用MoBA注意力解决长时间漂移。不过目前只开放了检查点,没有完整代码。原文稍后读已读值得跟进有用关注 LingBot-World-Infinity
12:19官方账号arXiv cs.AI@Xinyan Chen, Ziyu Guo, Renrui Zhang, Dongzhi Jiang, Hongsheng LiOpenCoF 是一个包含 OpenCoF-17K 数据集和 Wan-CoF 模型的推理框架,覆盖 11 个任务家族。在 4 个视频推理基准上,Wan-CoF 相比 Wan2.2-I2V-A14B 基线取得显著提升。模型引入视觉和文本推理 token,分别捕捉低级视觉线索和高级语义先验。实验通过注意力分析探讨了这些 token 在不同深度、去噪步骤、空间和时间上的贡献。论文OpenCoFWan2.2-I2V-A14B视频生成推荐理由:这篇论文用视频帧序列做推理,比传统的思维链更直观。他们把 Wan2.2 模型微调成 Wan-CoF,在多个基准上分数更高,还开源了数据集和代码。原文稍后读已读值得跟进有用关注 OpenCoF
09:54berryxia@berryxiaHyperFrames近期更新,新增音乐驱动的视频自动剪辑功能。AI将歌曲拆解为时间地图,包括BPM、节拍、乐句转折和能量起伏等结构化信息。所有视觉切点、高潮和音效严格对齐音乐节点,用户只需输入一句提示词(如“30秒科技新闻片”)即可生成。AI会自动挑选歌曲中最抓人的片段并组装,长度锁定到最近的鼓点。配合Codex使用性价比最高。AI产品HyperFramesCodex音乐驱动推荐理由:HyperFrames现在能根据音乐节奏自动剪视频了,你丢一首歌进去再给句提示,它就把长度和对齐都搞定,跟Codex搭配效果更佳。原文稍后读已读值得跟进有用关注 HyperFrames
05:54官方账号NVIDIA AI@NVIDIAAI精选Flex-Forcing是NVIDIA研究团队发布的视频生成方法。当前主流方法有双向扩散(同时建模所有帧,结构稳但慢)和自回归(逐帧生成,快且支持长片段,但漂移)。Flex-Forcing训练单一模型在推理时可根据计算预算选择任一种方式或中间态。AI模型NVIDIAFlex-Forcing视频生成7 个信源在谈事件专题推荐理由:NVIDIA新出的Flex-Forcing,一个模型就能在双向扩散和自回归之间切换,想快想稳都行,挺省事的。原文稍后读已读值得跟进有用关注 NVIDIA
22:42Ate-a-Pi@svpino76°新开源模型支持交互式视频生成,最长可达1小时。模型内置Agent驱动整个生成流程。代码和权重已开源在GitHub和HuggingFace。该模型适用于长视频创作场景。AI模型视频生成交互式Agent推荐理由:这个新模型能交互式生成1小时视频,还有Agent全程驱动,做长视频的开发者可以试试。原文稍后读已读值得跟进有用关注 视频生成
20:40Hailuo AI@Hailuo_AIMiniMax联合Telkomsel和华为举办了AI Cinefest 2026创作大赛,共吸引1000名AI创作者报名。经过筛选,100名创作者晋级线下决赛。决赛将于7月11日在雅加达的MiniMax Hub创意实验室举行,参赛者需在一天内完成从剧本到最终成片的全部流程。行业MiniMaxHailuoTelkomsel推荐理由:MiniMax和Telkomsel、华为一起办了场AI电影创作大赛,1000人报名选100进决赛,7月11日雅加达现场从零到成片一天搞定,去瞅瞅吗?原文稍后读已读值得跟进有用关注 MiniMax
15:11IT之家(博客/媒体)精选蚂蚁灵波科技开源LingBot-Video,这是全球首个基于MoE架构的面向具身智能视频生成基础模型。模型总参数30B,生成时仅激活约3B,推理效率是同等Dense架构的3倍。训练数据包含7万小时机器人相关数据,结合多维强化学习奖励系统。在RBench基准上总分0.620,超越Wan2.6(0.607)、Seedance 1.5 Pro(0.584)等模型。可用于机器人动作预测、仿真数据生成等方向。AI模型LingBot-Video蚂蚁灵波MoE推荐理由:蚂蚁灵波开源了LingBot-Video,专为机器人设计,RBench上超过Wan2.6,推理快3倍,适合做训练数据。原文稍后读已读值得跟进有用关注 LingBot-Video
15:00量子位@十三该模型采用MoE架构,专为机器人具身场景设计。它首次将混合专家模型用于视频生成与动作控制的融合。模型已开源到GitHub,参数量为7B。在RoboCasa基准上取得了领先成绩。AI模型MoE具身智能视频生成推荐理由:这是首个专门给机器人做的MoE视频模型,能看懂视频并规划动作,还开源了,做具身智能的值得看看。原文稍后读已读值得跟进有用关注 MoE