#图像生成
xAI 的 Grok Imagine Image 2.0 上线 OpenRouter,能规划排版和布局,适合做设计稿和插画,和普通文生图不一样。
xAI出Imagine Image 2.0了,Arena排名仅次GPT-Image-2,还有Magic Wand编辑工具,可以试试。
SpaceXAI的Grok Imagine 2.0在文生图竞技场直接冲到第二,图片编辑也第二,现在只在App里能用,想试试可以去下载。
SpaceXAI 发布 Imagine Image 2.0,能局部修图、抠背景、多图合成,文生图和编辑都排全球第二,仅次于 GPT Image 2。
阿里新出的Qwen-Image-3.0-Pro,生成文字特别清晰,能处理超长提示,一张图0.04美元起,做海报、试卷都合适。
OpenRouter 出了个新 Playground,打开就能玩 GPT-Image,生成、改图、拼图都行,比你自己搭环境省事多了。
商汤开源了新多模态模型,8B参数就能生成4K图,编辑效果还追上闭源大厂,想玩图像生成的可以试试。
Google把Nano Banana 2塞进Google Earth,结果有人用它生成了假卫星照片,两天就被下线了。看看怎么做到的。
Ideogram和PrunaAI合作的新图像模型P-Image-Ideogram,四种模式可选,原生2K,每张图最低3厘钱,API已开放,快去试试。
Ideogram 新模型 P-Image-Ideogram 上线了,你可以在 ComfyUI、Runware 等 15 个平台直接用,质量很能打。
ListenHub和Labnana刚上了Seedream 5.0 Pro,画动漫比GPT Image 2还好,还能局部修图,快去试试!
微软自己训练的新图像和语音模型,不用别人蒸馏,已经在Bing和PPT里用了,GPU成本降了八成多,价格也公开了。
阿里新图模型 Qwen-Image-3.0 能一次生成复杂图文排版,文字小到10px也清晰,考卷报纸都能画,实用性强。
这篇论文搞了个Appearance Pointers,能让DiT模型精确指定图片不同区域该长什么样,不用重训模型,效果还比那些专门的方法好。