生数科技的 Vidu Q4 Preview 能一次塞 15 张参考图和 3 段音频生成视频,直接输出 4K,价格 0.09 元一秒起。
#视频生成
Odyssey-3 Pro 在物理理解基准 Physics-IQ 上拿到 66.1 分冲到榜首,还能让你在生成的环境里随便走动触发事件看它怎么应对。
MiniMax H3 出了个人物移除 LoRA,用 SAM 3.1 追踪再补背景,做视频擦人挺实用,模型在 Hugging Face 上能直接下。
SpaceXAI 出了个便宜版视频模型,排名超过 Veo 3.1 但价格只有三分之一,10 秒 1080p 一分钟内就能生成,API 上就能调。
HeyGen 和房产大佬 Ryan Serhant 合作,让他的数字人每天出镜讲销售和品牌,本人一条都不用拍,想看数字人怎么商用可以了解下。
xAI 把 Grok Imagine Video 1.5 Lite 接入了 OpenRouter,做视频生成可以直接调用,1080p 也才每秒 0.14 美元,价格挺实在。
Anthropic 和 Runway 联手了:Claude Motion 能把数据做成动画讲解,再丢进 Runway 生成视频,做演示的人可以试试。
Anthropic 给 Claude 加了 Dashboards 和 Motion 两个新功能,输入文字就能做实时数据仪表盘和动画讲解视频,免费用户也能用 Docs 和 Slides 了。
Stability AI 出了个叫 SemanTok 的新方法,把视频开头的 token 做得更语义化,小模型能打三倍大的模型,做视频生成的可以看看这篇论文。
Pollo AI 把 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5 串起来做广告图和视频,做营销的可以看看别人怎么组合这几个模型。
Perplexity 把 OpenAI 那批 722 篇数学论文全做成了解说视频,共 93 小时,在 YouTube 直接看。
Odyssey-3 能生成会对你操作实时反应的互动世界,Flash 版免费可玩,还顺手在 Physics-IQ 拿了 66.1 的高分,去看看 demo。
ElevenLabs 的 ElevenCreative 上线了 Brand Kit,做品牌内容生成时可以直接套用自己的品牌素材,用这家的朋友可以去试试。
一家泰国广告公司分享他们怎么用 WonderClip 干掉视频制作里的重复活儿,人只管创意把关,做视频的可以看看他们的流程。
有人拿 Haiku 5.5 给模型自己做宣传片,200 tok/s 跑了 1.6 亿 token 才花 3 刀,成品效果接近 Opus 5.5,成本玩法很值得参考。
生数科技的 Vidu Q4 Preview 一上线就冲到 Artificial Analysis 视频榜第 3,能出 4K 带音频的视频,价格还和上一代一样,可以试试。
AI 短剧用真人剧一成的成本把红果榜单前 20 占了 19 个位置,横店摄影棚空了近八成,这篇把成本、产能和失业冲击都讲清楚了。
Meta 的 Muse 才上线一个月就拿下 180 万日活,Citi 直接给出 2030 年 270 亿美元年收入预测,数字挺具体,可以看看。
Ben Affleck 居然会写 Python、讲得清 CNN 和张量,还靠刷脸进了 Google 和 OpenAI 看视频模型,反差挺大的。