Meta新出的Muse Image和Muse Video,图像生成能精准按指令做,视频还带原生音频,比之前的模型强不少。
#视频生成
Meta 发了两个新模型 Muse Image 和 Muse Video,一个能画图还能编辑,一个能生成视频带声音,可以在 Instagram 里直接用了。
Meta新出的视频模型Muse Video直接冲到了排行榜第三,还比阿里的HappyHorse高30分,图像模型Muse Image也能调用工具了。
Meta新出的Muse Image和Muse Video在基准测试中表现超强,Muse Image仅次于GPT Image 2,视频模型也排第三,值得看看具体排名。
Meta的Muse模型不仅能生成高质量图像视频,还能做精准原地编辑,带智能体规划功能,比宣传更实用。
Kyutai Labs开源了MIRA,一个在神经网络里直接跑《火箭联盟》的模型,5B参数、20fps,不用游戏引擎纯靠学习生成,比传统游戏模拟器有意思多了。
Anthropic 的 Fable 5 回来了,1 小时一个人就能做出游戏宣传片级别的视频,省掉几万块和几周时间,视频创作者可以试试。
字节豆包 Seedance 2.5 要上线体验中心了,能生成 30 秒视频还能同时用 50 个素材编辑,实打实提升视频创作效率。
谷歌新模型 Gemini Omni Flash 在盲测中赢了字节 Seedance 2.0 Mini 101 Elo,视频生成质量被用户投票认可,想看看最新视频生成标杆可以关注。
Poe 刚上了两个新模型:Claude Fable 5 回归,Gemini Omni Flash 能对话式编辑视频,很值得试试。
Google 出了个便宜好用的视频生成模型 Gemini Omni Flash,直接用自然语言改视频,快去 AI Studio 试试。
阿里云这个Happy Horse工具做出来的短片,在AI电影节拿下了第二,画面很有冲击力,讲的是拼凑破碎才能创造,挺有意思。
Google把Nano Banana 2 Lite和Omni Flash串起来,先4秒出图再直出动画,比主流模型快且便宜。创意迭代更爽。
Philipp Schmid 放了个 skill,一行命令就能让 agent 用 Gemini Omni Flash 做视频编辑,四个玩法直接抄
Google 一口气发了两个新东西:一个超快的图像模型 Nano Banana 2 Lite,一个能生成视频的 Gemini Omni Flash API,都是实际能用的。
DeepMind 让 Nano Banana 和 Gemini Omni 能配合干活了,先画图后动画,还能连续改三次,挺实用。
Runway 把 Gemini Omni Flash 塞进视频工具里了,用一句话、一张图或一段视频就能编辑和生成新内容,省掉繁琐剪辑。
Google DeepMind的Gemini Omni Flash视频编辑能力强,比对手高40分,还发布了更便宜的图像模型Nano Banana 2 Lite。
Google一口气发了两个模型:一个4秒出图,一个直接生成视频,还能连起来用,成本还低,搞创作的可以试试。