7月25日
13:11
13:11量子位@henry
Vivix推出首个实时互动模型,采用统一流式架构。单卡视频生成速度突破10000 video tokens/s。该模型打通实时多模态生成全链路,支持视频、图像、音频等模态的实时交互。相比传统非实时方案,延迟降低至毫秒级。
推荐理由:Vivix这个新模型单卡就能每秒生成上万视频token,做实时互动视频、多模态聊天特别带劲,比之前那些慢吞吞的方案强多了。
7月24日
22:07
22:07官方账号Runway ML@runwayml
Runway 在 Runway Agent 中引入 Workflows 功能,用户可以通过自然语言描述来构建、运行或编辑基于节点的工作流。该功能旨在帮助用户以规模化方式生成高质量的输出。目前可通过调用 /Workflow 技能试用。
推荐理由:Runway 出了个新玩法:用自然语言就能搭节点工作流,不用拖拽连线了,适合批量做高质量视频输出。
12:22
12:22官方账号arXiv cs.AI@Vedant Shah, Onkar Susladkar, Tushar Prakash, Kiet Nguyen, Tianjio Yu, Adheesh Juvekar, Muntasir Waheed, Ismini Lourentzou
GraphVid是一种基于图结构的图像到视频生成模型,通过交互图实现多对象精准控制。研究团队构建了GraphVid-Bench数据集,包含结构化关系标注。与Motion-I2V相比,GraphVid的FID降低39.9%,FVD降低37.6%,PSNR从9.87提升至15.98,SSIM从0.38提升至0.61。该方法使用更少训练数据和参数,在可控性和质量上均表现更优。
推荐理由:想精确控制视频里多个物体的互动?GraphVid用交互图代替画轨迹,效果比Motion-I2V好很多,FID降了40%。
00:33
00:33官方一手歸藏(guizang.ai)@op7418
81°
Black Forest Labs 发布了 Flux 3 视频生成模型,并开源了 Dev 版本。该模型支持文生视频、图生视频(作为参考或起始帧)、视频参考生成、关键帧控制、音频延长等 8 项功能。用户可申请早期访问,API 将在未来几周内开放,后续提供完整开源版本。
事件专题

推荐理由:Black Forest Labs 开源了 Flux 3,功能超全:文生视频、图生视频、关键帧控制、视频延长,还支持文字动画和智能剪辑,像开源的 Sora。
7月23日
23:57
23:57Justine Moore@venturetwins
81°
Black Forest Labs 推出 FLUX 3,一个统一多模态模型,支持图像、视频、音频和动作预测。其视频生成能力突出,单次提示即可生成最长20秒的多镜头视频,细节逼真。目前 FLUX 3 Video 已开放早期访问。该模型采用统一架构训练,可扩展至机器人动作预测。
事件专题

推荐理由:Black Forest Labs 的 FLUX 3 能用一个提示生成20秒多镜头真实视频,还可以做图像、音频和机器人预测,很值得试试。
20:22
20:22官方一手歸藏(guizang.ai)@op7418
黑森林工作室在预告中透露了新一代模型 FLUX 3。该模型支持图像、视频、音频和动作生成,是一个全模态生成模型。单条视频支持一次生成20秒。根据过往规律,该模型可能开源。
事件专题

推荐理由:黑森林工作室的 FLUX 3 预告来了,全模态还能一次生成20秒视频,可能开源,老用户该关注了。
17:55
17:55官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云在WAIC大会期间主办了AI Video Creatorthon视频创作马拉松。首个获奖作品完全由其视频生成模型Happyhorse制作完成。该作品展现出高度一致性和丰富细节,体现了当前AI视频生成工具的能力。

推荐理由:阿里云用自家模型Happyhorse搞了个AI短片创作赛,获奖作品效果稳定细节丰富,值得看看AI视频现在能做到什么程度。
02:15
02:15HeyGen@HeyGen_Official
HeyGen 发布伴侣模式(companion mode),用户可通过该模式让AI代理提出5个视频角度,自动生成故事板并绘制草图。用户每步可审查和调整创意,只有在批准后才进入最终构建阶段。该功能通过 npx hyperframes @latest 命令启动,旨在将视频制作从“下单”变为“执导”。
推荐理由:HeyGen 的伴侣模式让你像导演一样指挥AI,而不是简单下订单。它帮你构思5个角度、画故事板,每一步都让你把关,确保视频符合你的想法。
7月22日
16:46
13:16
13:16向阳乔木@vista8
Yoroll平台创作者使用约250美元积分在2天内将《奥德赛》改编为40分钟可玩的AI故事游戏。游戏支持对话式选择,生成不同剧情走向。相比诺兰2.5亿美元电影制作成本,成本差距达100万倍。游戏包含AI生成的宏大视频画面,适合边玩边学英语。

推荐理由:Yoroll上有人只花250美元就做出了40分钟的AI版《奥德赛》游戏,视频很宏大还能选剧情,成本比诺兰电影便宜一百万倍。
7月21日
22:18
22:18LovartAI@lovart_ai
Lovart 使用 GPT 5.6 SOL 和 Kimi K3 两个模型,通过 Seedance 2.0 渲染同一段视频提示词,产出了风格迥异的两个短片。测试展示了不同模型对相同创意要求的差异化执行效果。两个模型在同一起点下的表现形成了直观对比。
事件专题

推荐理由:想知道 GPT 5.6 SOL 和 Kimi K3 在视频生成上有多大差别?同一个提示词,两个 AI 导演各拍一版,看完你就懂了。
18:19
17:44
17:44官方账号阿里云 Alibaba Cloud@alibaba_cloud
精选
阿里云在东京举办AI视频黑客马拉松,超过50名创作者参与。他们使用世界排名第一的AI视频生成模型HappyHorse 1.1,在一夜之间将创意转化为15秒商业广告。大奖作品是一个利用通勤列车离心力烘干衣物的创意。HappyHorse 1.1现已开放试用。

推荐理由:阿里云用他们的顶级视频模型HappyHorse 1.1搞了个黑客松,一夜出片。大奖创意是用火车甩干衣服,挺有意思。戳链接能直接试这模型。
16:38
16:38官方账号阿里云 Alibaba Cloud@alibaba_cloud
72°
阿里云推出企业级AI视频制作工具WonderClip,用户只需输入脚本,即可自动生成完整视频。该工具覆盖从脚本撰写到最终剪辑的全流程自动化。官方将于2026年7月23日10:00(UTC+8)进行直播演示。

推荐理由:阿里云新出的WonderClip,输入脚本就能自动剪出完整视频,企业级质量,省掉剪辑团队。22号有直播,可以看看效果。
13:01
11:40
11:40官方账号arXiv cs.AI@Lopez Jhon, Hinojosa Carlos, Ghanem Bernard
SGA (Symbolic Geometric Agent) 是一个即插即用模块,拦截LLM生成的Manim代码,通过部分执行提取场景图并检测几何遮挡问题。实验在MMMC-Code基准上,使用4种LLM后端和2种流水线配置,SGA在Code2Video + GPT-5.1配置下达到73.11的MVQS分数,相对原始基线提升16.1%。SGA在8种配置中有7种提升了MVQS。
推荐理由:论文提出了SGA模块,能自动修复LLM写动画代码时的几何遮挡错误,实测用GPT-5.1搭配Code2Video能提升16%的画面质量。
7月20日
7月19日
18:43
18:43官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云发布针对个人的Token Plan,统一积分支持文本、图像和视频生成。包含Qwen3.8-Max-Preview、GLM-5.2、DeepSeek-V4-Pro等模型,以及Happy Horse 1.1用于视频生成。首月优惠价仅4美元(使用优惠券后)。该计划提供多模态统一计费方式。
事件专题

推荐理由:阿里云新出的个人套餐,一个Token包圆文本、图像和视频,首月才4美元,性价比不错。
10:12
7月18日
20:14
20:14量子位@量子位的朋友们
万兴科技在WAIC 2026上展示了万兴剧厂的“无限画布”功能,该功能支持超大尺寸视频创作。同时首秀了Filmora.AI,集成AI剪辑与生成能力。另一款新品Virbo AI专注于数字人形象生成与驱动。三款产品均面向AI视频创作场景。
推荐理由:万兴把三个AI视频工具都带到WAIC了,无限画布做大片、Filmora.AI剪视频、Virbo AI做数字人,想玩AI视频的可以看看。