AI模型精选71°

Meta发布新图像模型Muse Image并预览Muse Video

最近几乎没有声量的Meta 也发布新图新模型了! Meta Superintelligence L…

精选理由

Meta这次把图像生成做成了带智能体能力的工具,还能结合Instagram上下文,跟GPT和SD的思路不太一样。

AI 摘要

Meta Superintelligence Labs发布了Muse Image,这是其目前最强的图像生成模型,强调忠实遵循指令、精准编辑、多参考图合成,并能调用Instagram社交上下文生成内容。Muse Image引入了agentic tool use能力,与Muse Spark深度整合,使图像生成成为带规划和工具调用的多步过程。同时预览的Muse Video基于同一预训练底座,目标实现高视觉保真度和原生音频支持。整体方向是将图像/视频生成从纯视觉模型转化为理解社交语境、支持多步agentic操作的创作工具,并嵌入Meta社交产品。

原文 · berryxia

最近几乎没有声量的Meta 也发布新图新模型了! Meta Superintelligence L…

最近几乎没有声量的Meta 也发布新图新模型了!

Meta Superintelligence Labs发布了Muse Image,同时预览了Muse Video。

Muse Image是他们目前最强的图像生成模型,强调忠实遵循指令、精准编辑、多参考图合成,还能调用Instagram的社交上下文来生成内容。

同时引入了agentic tool use能力,并与Muse Spark深度整合,让图像生成不再是单次prompt,而是带规划和工具调用的过程。

Muse Video则基于同一预训练底座,目标是实现高视觉保真度 + 原生音频支持。

整体方向很清晰:把图像/视频生成从纯视觉模型,变成能理解社交语境、支持多步agentic操作的创作工具,并直接嵌入Meta的社交产品里。

Ps:实际还没有体验,估计还是到不了GPT和SD、Grok这些水平,后续看看怎么样再反馈给大家。