8月20日
02:26
02:26Mustafa Suleyman@mustafasuleyman
精选
微软推出的MAI-Image-2.5-Pro成为Artificial Analysis图像编辑榜单第一名,超越了Reve 2.1、GPT Image 2等模型,同时在文本转图像领域位列第七;该模型于7月23日在Microsoft Foundry预览发布,主打高质量图像处理功能。
事件专题

推荐理由:微软发布了MAI-Image-2.5-Pro,做高质量图像编辑很厉害,比Reve 2.1这些模型表现更好,适合专业图像任务使用。
8月19日
03:33
03:00
8月8日
13:58
8月5日
12:32
01:48
01:48OpenRouter@OpenRouterAI
OpenRouter 新增了图像模型 Playground,用户可以在浏览器中直接试用 OpenAI 的 GPT-Image 模型。该 Playground 支持快速生成、编辑和组合图像,无需自行搭建环境。入口链接指向 openrouter.ai/openai/gpt-ima... 页面。
事件专题

推荐理由:OpenRouter 出了个新 Playground,打开就能玩 GPT-Image,生成、改图、拼图都行,比你自己搭环境省事多了。
7月31日
17:26
7月30日
02:11
02:11Ideogram@ideogram_ai
Ideogram推出的Object Remover在RemovalBench基准测试中排名第一,超越Nano Banana 2、FLUX Erase和GPT Image-2等主流图像编辑模型。该工具不仅移除质量最高,还提供每请求最低的价格。测试结果显示其综合性能领先。

推荐理由:Ideogram新出的物体移除工具,在RemovalBench上拿了第一,价格还最低,想清理图片里杂物可以试试。
7月24日
15:51
7月13日
18:29
18:29官方一手歸藏(guizang.ai)@op7418
Seedream 5.0 Pro 的图像精细编辑能力结合模型与交互,可对图像进行精准区域编辑。标注区域与生成区域的颜色能完美融合,无溢出。该教程详细演示了如何在Lumion中操作这套功能。

推荐理由:想要精准修图吗?Seedream 5.0 Pro 能让你画个区域就自动融合颜色,教程手把手教你用Lumion玩起来。
7月8日
23:55
23:55berryxia@berryxia
Seedream 5.0 Pro 现已上线字节云平台,该版本支持精准编辑、可视化复杂信息、渲染逼真图像与肖像。相比前代,它融合了香蕉的替换主体与编辑主题能力,以及类似 Image-GPT-2 的分层编辑功能。用户可通过该模型实现多语言创作下的精细化图像修改。
事件专题

推荐理由:字节云上新了Seedream 5.0 Pro,能做分层编辑和精准图像修改,类似Image-GPT-2的玩法,适合做设计或视觉内容的朋友试试。
23:00
23:00小互@imxiaohu
Seedream 5.0 Pro 正式发布,官方效果图显示其生成质量接近 GPT image 2。新版本支持高密度信息表达、交互式精准编辑、智能图层分离,影像与人像质感真实。同时原生支持多语种输入与生成,可处理英文、中文等多种语言。

推荐理由:Seedream 出了5.0 Pro,图像生成能跟GPT image 2掰手腕了,还自带图层分离和多语种输入,做设计的朋友可以试试。
10:17
10:17官方账号arXiv cs.AI@Yoav Baron, Sara Dorfman, Roni Paiss, Daniel Cohen-Or, Or Patashnik
本文研究VLM在扩散图像编辑管线中作为条件编码器时的定位能力下降问题。作者提出Analysis-by-Proxy框架,训练轻量级代理模型在VLM中间表示上执行辅助定位任务。实验发现,在单次前向传递约束下,定位信号未可靠传播到预设条件层配置,而是隐藏在随输入提示变化的中间表示中。该框架揭示了现有编辑管线条件提取策略的根本失败,为设计更合理的条件架构提供了方向。
推荐理由:这篇论文把VLM做图像编辑时定位不准的老问题挖到底了——原来不是模型不行,是提取信号的方式错了。他们用了个'代理分析'的巧招,把隐藏的定位信号给揪了出来,搞编辑管线的值得一看。
01:06
01:06官方一手AWS Machine Learning Blog@Salman Ahmed
精选
这篇教程教你用Amazon Bedrock AgentCore构建一个无服务器图像编辑智能体,用户上传照片后用自然语言描述编辑请求,数秒内返回结果。整个方案包含认证、加密存储、三个图像编辑工具以及React前端,只需一条命令即可部署。基础设施用AWS CDK定义,无需自定义编排代码。
推荐理由:跟着做就能搞出一个能理解自然语言指令的图像编辑器,部署还特别省心,一条命令搞定全套,试试看。
7月2日
6月29日
6月12日
13:28
13:28官方账号Microsoft AI@MicrosoftAI
微软发布了其图像生成与编辑模型MAI-Image-2.5,该模型能够生成高度逼真的照片级图像,并支持精确编辑。一个有趣的细节是,其官方宣传图全部由模型本身生成,展示了其在细节和真实感上的强大能力。用户现在可以在微软Playground或OpenRouter上免费试用该模型。

推荐理由:微软MAI-Image-2.5在照片级真实感和精确编辑上表现出色,做设计、内容创作或AI图像研究的团队值得一试,直接在Playground或OpenRouter上体验其生成效果。
6月3日
09:52
09:52berryxia@berryxia
微软发布的新模型 MAI-Image-2.5 在图像编辑能力评测中取得第二名,仅次于 OpenAI 的 GPT-Image-2。该模型超越了 Google 的 Nano Banana 模型,显示出微软在图像生成与编辑领域的快速进步。评测结果引发了对 Google 在 AI 图像领域创新速度的讨论,部分用户表示期待 Google 推出更强的新模型。
事件专题

推荐理由:图像编辑模型竞争白热化,微软 MAI-Image-2.5 已超越 Google,做 AI 图像生成或编辑的开发者可以关注这个新选择,看看它和 GPT-Image-2 的差距在哪。
08:12
08:12OpenRouter@OpenRouterAI
微软发布 MAI-Image-2.5 模型,在文本到图像和图像到图像排行榜上分别位列第3和第2,性价比领先市场。该模型支持精准的图像生成与编辑,目前已在 OpenRouter 平台上线。对于需要高质量图像生成且预算有限的团队,这是一个值得关注的选择。
事件专题

推荐理由:微软 MAI-Image-2.5 以市场领先的性价比登顶排行榜,做图像生成或编辑的团队可以直接在 OpenRouter 上试用,省下不少成本。