#图像生成
Google 出了个 Nano Banana 2 Lite 图像模型,最快最便宜,能生成沃尔多风格找图,比上一版好但拼写会错。
Google一口气发了两个模型:一个4秒出图,一个直接生成视频,还能连起来用,成本还低,搞创作的可以试试。
Google新出了两个模型:Lite低成本快速出图(4秒/张,千张34美元),Omni Flash视频生成在LMArena登顶,性价比不错。想省钱做图或搞视频的可以关注。
Google新出两个模型:一个4秒出图只要3分钱,另一个能文字生成视频,还能链着玩。
Google 发了两款新模型:一个 4 秒出图、千张只要 3 分 4;另一个视频编辑达到 SOTA 且和 Veo 3.1 Fast 一样便宜。
微软 MAI-Image-2.5 图像生成排第2、编辑排第3,还能把雨窗变清晰,想用去 Foundry API 或 OpenRouter 试试。
一个人用一张3090 Ti发SIGGRAPH,InfiniteDiffusion无限图像生成、Terrain Diffusion比卫星快9倍,代码开源,快去试试Minecraft mod。
想快速试不同画风?现在 Midjourney 草稿模式下加个参数,一次出 24 种随机风格,比手动换 sref 方便多了。
前Databricks AI老大搞了个新公司,说能让AI耗电降到原来的千分之一,他们先做了个图像生成系统Un0,如果真能兑现,那AI成本得崩盘。
Krea 2 开源了双版本,RAW 用来训练 LoRA,Turbo 跑推理,直接用 SGLang 就能跑,比闭源模型更灵活。
OpenAI 的新图像模型 GPT Image 2 现在能用 Together AI 的无服务器接口调用了,做多模态应用时直接用它生成和编辑图片,支持布局和文字控制,挺方便。
PrunaAI 出了个超便宜的虚拟试穿模型,第一件才一分五,快至2秒一件,还能一次穿11件,电商团队看过来。
微软MAI-Image-2.5在照片级真实感和精确编辑上表现出色,做设计、内容创作或AI图像研究的团队值得一试,直接在Playground或OpenRouter上体验其生成效果。
开源图像生成模型终于有了更可控的提示方式——JSON 和边界框让精确布局成为可能,做 AI 绘画工具或创意生成的开发者值得关注社区玩法。
Midjourney 用户终于等来了更快的生成速度和更低成本,V8.1 的 2K 渲染和图像提示回归让创作更高效,建议立即体验新默认模型。