主要来源shao__meng
查看原文事件专题 · 多源确认
FLUX 3 发布:Black Forest Labs 推出真实世界模型
Black Forest Labs 发布 FLUX 3,定位为真实世界模型,统一处理图像、视频、音频三种模态。模型最长生成约20秒带原生音频的视频,支持续写、关键帧、多语言对白。图像合成与编辑功能将在数周后推出,强化复杂 prompt 和文字渲染。动作预测已通过 FLUX-mimic 用于 mimic robotics 和 Audi 场景。
当前结论
FLUX 3 把图像、视频、音频放一起训,还能预测动作。已经能生成20秒带声音的视频,图像也快上了。
8 个信源72° AI 热度最后更新 2026/7/24 03:44:57
证据链
相关来源 1berryxia
查看原文相关来源 2Latent Space (swyx)
查看原文相关来源 3歸藏(guizang.ai)
查看原文相关来源 4Justine Moore
查看原文相关来源 5Decoder
查看原文相关来源 6@koltregaskes
查看原文相关来源 7岚叔
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。