8月21日
16:03
05:53
05:53官方一手@OpenAIDevs@OpenAIDevs
78°
OpenAI 在 GPT-Image-2 API 中新增透明背景功能预览。用户可生成可复用的图像资产,用于产品展示、平面设计、网站原型和营销活动。该功能允许图像元素放置在任何背景上。
事件专题

推荐理由:OpenAI 给 GPT-Image-2 API 加了透明背景预览,生成的图能直接抠出来用,比以前方便多了。
8月19日
11:45
11:45官方账号arXiv cs.AI@Xingjian Wang, Zhao Wang, Taihang Hu, Jun Zheng, Qing Jin, Qinye Zhou, Zhengtao Wu, Yongchao Du, Zuan Gao, Chao Lin, Yefeng Shen, Xiaoli Xu, Zhengze Xu, Hao Yan, Yuhang Yu, Mingzhou Zhang, Mengting Chen
精选
研究人员提出能力驱动的数据基础设施,构建了440M图像的T2I语料库和120M编辑对。该框架包含三个专门数据引擎,为文本-图像接地、图像间转换和图像-知识关联提供监督。基于此,团队训练了3B和6B两种规模的多模态扩散模型,在CPI-Bench评估中展现广泛视觉覆盖和多功能渲染能力。
推荐理由:这篇论文提出了一种新数据设计方法,训练出能同时处理多种图像生成任务的大模型,比传统方法更高效。
03:33
8月14日
8月13日
18:03
18:03官方账号Runway ML@runwayml
Runway 宣布 Grok Imagine Image 2.0 上线其平台。该模型是 Runway 当前提供的最新图像生成模型,与平台上其他图像和视频模型并列。用户现在即可通过 Runway 官方链接试用 Grok Imagine Image 2.0。
推荐理由:Grok Imagine Image 2.0 现在能在 Runway 直接用了,和顶级图像视频模型放一块,试图像生成又多了个选择。
8月12日
17:03
17:03官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里云Qwen团队宣布Qwen-Image-3.0已上线OpenArt平台。该模型支持12种语言的原生文本渲染,能精确生成10像素大小的文字。它还能根据真实世界知识渲染完整界面,如网页、游戏和直播画面。这是目前最逼真的Qwen图像模型。
推荐理由:想生成带文字的海报或网页截图?Qwen-Image-3.0在OpenArt上就能用,支持12种语言,文字渲染到10px都清晰。
09:26
09:26OpenRouter@OpenRouterAI
xAI 的 Grok Imagine Image 2.0 现已通过 OpenRouter 提供。该模型专为可实际使用的图像设计,能规划排版、布局和多部分视觉内容。它在摄影、设计和插画等场景下保持高保真度。OpenRouter 平台已支持调用该模型。
事件专题

推荐理由:xAI 的 Grok Imagine Image 2.0 上线 OpenRouter,能规划排版和布局,适合做设计稿和插画,和普通文生图不一样。
8月11日
8月9日
13:03
8月8日
16:46
16:46官方账号Decoder@Matthias Bastian
xAI发布新一代图像生成模型Imagine Image 2.0,现已集成到Grok中。该模型在Arena基准上排名第二,仅次于OpenAI的GPT-Image-2。新增Magic Wand和Multi-Ref Editing等编辑工具,同时提供预配置模板。这些功能主要面向实际的创意工作流。
事件专题

推荐理由:xAI出Imagine Image 2.0了,Arena排名仅次GPT-Image-2,还有Magic Wand编辑工具,可以试试。
8月7日
21:44
21:44Recraft@recraftai
Recraft V4.1 官方样张主打微距细节,涵盖水滴、花瓣纹理和昆虫皮肤。近距离查看时,锐利区域和柔和虚化过渡层次分明,没有常见的蜡质 AI 感。V4.1 对自然材质的渲染更接近真实,适合高放大倍率的特写生成。

推荐理由:Recraft V4.1 出了,微距样张很能打,水滴、花瓣、虫皮都自然,不像一般 AI 图那种塑料感,做特写图可以看下。
8月5日
12:32
01:48
01:48OpenRouter@OpenRouterAI
OpenRouter 新增了图像模型 Playground,用户可以在浏览器中直接试用 OpenAI 的 GPT-Image 模型。该 Playground 支持快速生成、编辑和组合图像,无需自行搭建环境。入口链接指向 openrouter.ai/openai/gpt-ima... 页面。
事件专题

推荐理由:OpenRouter 出了个新 Playground,打开就能玩 GPT-Image,生成、改图、拼图都行,比你自己搭环境省事多了。
8月3日
21:27
8月1日
17:05
17:05官方账号Decoder@Matthias Bastian
Google在Google Earth中集成了Nano Banana 2图像模型,用户用简单提示词就能生成逼真的假卫星图像。有用户将美墨边境的一块空地凭空变成了一支难民队伍。该功能上线仅两天就被Google撤下。事件暴露了图像生成模型在卫星影像领域的滥用风险。
事件专题

推荐理由:Google把Nano Banana 2塞进Google Earth,结果有人用它生成了假卫星照片,两天就被下线了。看看怎么做到的。
01:51
7月31日
15:59
15:59AI Will@FinanceYF5
72°
有人在 X 上让 Claude 5 Opus 从零生成越野车和泥地赛道,全程不使用任何贴图。车身、轮胎、尘土和环境都由模型直接绘制,没有调用现成素材。这条演示推文附带视频,目前浏览量达 535 次。
推荐理由:有人让Claude 5 Opus零贴图直接画越野车和泥地赛道,连尘土都是生成的,视频看看效果。
7月30日
23:13
23:13Ideogram@ideogram_ai
P-Image-Ideogram是Ideogram与PrunaAI合作开发的图像生成模型系列,追求质量、速度和成本的最佳平衡。该系列提供四种质量模式,支持原生1K和2K分辨率生成,每张图像最低仅需0.003美元。模型现已通过API及合作伙伴平台上线。
事件专题

推荐理由:Ideogram和PrunaAI合作的新图像模型P-Image-Ideogram,四种模式可选,原生2K,每张图最低3厘钱,API已开放,快去试试。
15:41
11:09
11:09小互@imxiaohu
Magnific 发布了 38 页的全新提示词手册,核心观点是传统关键词式提示已失效。手册提出 AI 已进入推理(Reasoning)与导演对话时代,需要用明确的专业视觉语言指挥前沿模型。该手册针对当前主流图像和视频生成模型提供实用指南。

推荐理由:Magnific 出了本 38 页的提示词手册,教你用导演思维跟 AI 对话,不再堆关键词,适合想用好前沿图像视频模型的人。