15:01IT之家(博客/媒体)微软于8月10日推出新一代自研文生图模型 MAI-Image-2.6,在 Arena 文生图排行榜中以 1336 分位列第二,仅次于 OpenAI 的 GPT Image 2(Medium)。相比 2.5 版本,整体 Elo 评分提升 79 分,文本渲染能力单项涨幅达 91 分。模型排名从第十位跃升至第二位,领先 Meta、谷歌和 xAI 等竞品。在 3D 成像与建模类别中,该模型从第六位升至第一位,其他多个细分类别也有显著进步。新模型支持多参考图像融合,并增强语义理解与输出控制能力。AI模型MAI-Image-2.6微软文生图10 个信源在谈事件专题推荐理由:微软新模型直接干到文生图榜第二,文本渲染涨了91分,3D建模还拿了第一,想试的可以去Arena玩。原文稍后读已读值得跟进有用关注 MAI-Image-2.6
01:19Mustafa Suleyman@mustafasuleymanMAI-Image-2.5-Pro 今日在 Foundry 平台开放预览。这是微软最高保真度的专业级图像模型,支持高质量图像生成、精细编辑以及精确的图内文本渲染。该模型加入图像系列,开发者可根据质量、速度和成本选择适合的模型。AI模型MAI-Image-2.5-ProMicrosoftFoundry2 个信源在谈事件专题推荐理由:微软推出 MAI-Image-2.5-Pro 预览版,生成图像质量最高,还能精准渲染文字,适合专业场景。原文稍后读已读值得跟进有用关注 MAI-Image-2.5-Pro
17:43官方账号阿里云 Alibaba Cloud@alibaba_cloud81°阿里巴巴发布 Qwen-Image-3.0 图像生成模型,可处理长达4.5k tokens的提示词,实现复杂布局(如报纸、考卷、3×3信息图)的一次生成。该模型支持10px级文字清晰渲染、完整 LaTeX 论文页面输出,并能生成逼真的皮肤纹理和发丝细节。内置12种语言原生渲染、100多种艺术风格,具备世界知识和实时网页检索能力。AI模型Qwen-Image-3.0阿里巴巴图像生成推荐理由:阿里新图模型 Qwen-Image-3.0 能一次生成复杂图文排版,文字小到10px也清晰,考卷报纸都能画,实用性强。原文稍后读已读值得跟进有用关注 Qwen-Image-3.0
21:56官方账号阿里通义 Qwen@Alibaba_Qwen78°Qwen-Image-3.0 是阿里巴巴第三代基础图像生成模型,支持最长 4.5k token 的复杂布局生成,可一次性输出报纸、故事板、试卷、3x3 信息图网格及画中画 UI。模型实现 10px 可读文本、完整 LaTeX 论文页面、毛孔发丝级细节。原生支持 12 种语言、100+ 艺术风格,并集成实时网络检索能力。AI模型Qwen-Image-3.0阿里巴巴图像生成推荐理由:阿里新出的 Qwen-Image-3.0 能直接生成带看懂文字的报纸和试卷,细节连毛孔都清晰,做设计或电商配图很实用。原文稍后读已读值得跟进有用关注 Qwen-Image-3.0
15:00IT之家(博客/媒体)精选阿里发布Qwen-Image-3.0图像生成基础模型,支持最大4.5k token输入,可一次性生成复杂九宫格知识图解。该模型能精准渲染10px小字、毛孔发丝等细节,并支持12国语言和20多款字体原生渲染。在学术论文PDF测试中,模型完整渲染了包含多行复杂公式的代数几何论文。Qwen-Image-3.0还具备古画修复能力,能以原画风格补全缺失部分。目前阿里云百炼、千问AI平台已开通API邀测。AI模型Qwen-Image-3.0阿里图像生成推荐理由:阿里新出的Qwen-Image-3.0能一次生成4.5k token的复杂版面,连数学公式、多国语言小字都渲染得很清楚,做海报、UI排版效率很高。原文稍后读已读值得跟进有用关注 Qwen-Image-3.0
23:36官方一手歸藏(guizang.ai)@op7418Seedream 5.0 的图像模型上线,作者测试了几张图,包括生成游戏截图、科普图、UI 设计稿和剧情介绍图。模型支持 2K 分辨率,比 GPT-4o 更高,但文字细节方面,多文字时仍存在模糊问题。整体进步明显,比之前的图像模型提升较大。AI模型Seedream 5.0GPT-4o图像生成推荐理由:Seedream 5.0 图像模型刚上线,能生成 2K 分辨率图片,比 GPT-4o 清晰,但文字多时会糊。想试试新模型可以看看这些例子。原文稍后读已读值得跟进有用关注 Seedream 5.0
23:25The Rundown AI@therundownai字节跳动发布了Seedream 5.0 Pro,这是一个声称超越简单图像生成、能“理解设计”的AI模型。该模型在文本渲染、结构和对齐方面有改进,能生成高质量信息图和原型。它支持精确编辑,包括图层分离和多个图像组合。在写实度、光照和皮肤纹理上也有升级,并支持多语言输入和生成。AI模型Seedream 5.0 ProByteDance图像生成2 个信源在谈事件专题推荐理由:字节跳动的Seedream 5.0 Pro不仅能画图,还能分层编辑、组合多图,设计能力更强。原文稍后读已读值得跟进有用关注 Seedream 5.0 Pro
12:52官方账号Artificial Analysis@ArtificialAnlys精选Ideogram 4.0 是 Ideogram 首个开放权重的模型,在开放权重文生图排行榜上位列第8。该模型支持 2K×2K 分辨率输出,具备强文本渲染、边界框布局控制和透明背景生成能力。它使用结构化 JSON 提示词来指定构图和场景元素,并通过提示词增强器将自然语言转换为结构化格式。在 API 方面,提供 Turbo、Default 和 Quality 三个档次,价格从每千张 30 美元到 100 美元不等。权重可免费下载用于评估和非商业用途,商业自托管需单独授权。AI模型Ideogram 4.0开源/仓库文生图2 个信源在谈事件专题推荐理由:做图像生成或设计工具的开发者终于有了一个开源的高质量选择——Ideogram 4.0 的文本渲染和布局控制能力突出,且开放权重意味着可以本地部署和二次开发,值得关注。原文稍后读已读值得跟进有用关注 Ideogram 4.0
03:00官方账号Decoder@Matthias Bastian78°Ideogram 发布了其文本到图像模型 4.0 版本,作为开源权重模型,支持原生 2K 分辨率、边界框控制和改进的文本渲染。在 DesignArena 排行榜上,它在所有开源模型中排名第一,仅落后于 OpenAI 和 Google 的闭源系统。商业使用需要付费许可。AI模型Ideogram文本到图像开源模型10 个信源在谈事件专题推荐理由:对于需要高质量图像生成且注重文本准确性的创作者和开发者,Ideogram 4.0 的开源权重版本提供了顶级性能,值得尝试。原文稍后读已读值得跟进有用关注 Ideogram
01:09Justine Moore@venturetwins72°Ideogram 4.0 是一款新发布的开源图像模型,权重可下载,支持在自有硬件上运行和微调。该模型在文本渲染、高分辨率图像生成和设计方面表现优异,被官方称为“世界上最好的开源图像模型”。目前已在所有 Ideogram 计划和 API 上可用。用户可下载权重、用自己的数据微调,并在本地硬件上运行。AI模型开源/仓库图像生成文本渲染推荐理由:开源图像模型又添猛将,做设计、生成海报或需要高质量文本渲染的团队可以直接下载权重微调,值得一试。原文稍后读已读值得跟进有用关注 开源/仓库
00:32lmarena.ai@lmarena_ai76°Ideogram-4.0-Quality 在文生图领域成为新的开源模型第一名,在所有子类别上相比前代有巨大提升。尤其在文本渲染和产品、品牌与商业设计方面进步最为显著。该模型在公开评测中表现优异,标志着开源文生图模型质量迈上新台阶。AI模型Ideogram-4.0-Quality文生图开源模型推荐理由:做设计或品牌营销的团队终于有了一个能打的开源文生图模型——Ideogram-4.0-Quality 在文本渲染和商业设计上进步明显,值得直接上手试试。原文稍后读已读值得跟进有用关注 Ideogram-4.0-Quality
03:09官方账号Decoder@Matthias Bastian微软最新图像生成模型 MAI-Image-2.5 在 Arena 文生图排行榜上位列第三,与谷歌的 Nano Banana 2 持平,但仍落后于 OpenAI 的 Image-2。相比前代,该模型在图像内文本渲染和商业视觉内容方面有显著提升。这标志着微软在图像生成领域与谷歌的竞争进入白热化阶段,尤其适合需要高质量图文混排的营销和设计场景。AI模型微软MAI-Image-2.5谷歌7 个信源在谈事件专题推荐理由:做营销素材和电商设计的团队可以关注——MAI-Image-2.5 的文本渲染能力直接对标谷歌,生成带字海报和产品图更靠谱,值得在内部测试中对比一下。原文稍后读已读值得跟进有用关注 微软
12:06Paul Couvert@itsPaulAiHiDream-O1-Image 作为 Nano Banana 的开源替代品正式发布,采用 MIT 许可证,支持文本到图像、图像编辑、故事板生成等功能。该模型在文本渲染方面表现突出,提供 Hugging Face 模型和在线演示。这是开源社区在图像生成领域的重要进展,为开发者和创作者提供了更自由的选择。AI模型开源/仓库图像生成文本渲染推荐理由:图像生成领域终于有了 MIT 许可证的开源强模型,做创意工具或需要文本渲染的开发者可以直接上手试试。原文稍后读已读值得跟进有用关注 开源/仓库
14:51官方账号Midjourney@midjourney73°Midjourney 宣布开始测试其 V8 模型的早期版本,面向社区开放。新模型在提示跟随能力上大幅提升,生成速度提高了 5 倍,并支持原生 2K 分辨率模式。此外,文本渲染得到改进,个性化、风格参考和情绪板功能也达到最佳性能。这标志着 Midjourney 在图像生成质量和效率上的重要升级。AI产品MidjourneyV8模型图像生成推荐理由:Midjourney V8 的 5 倍速度和原生 2K 模式对设计师和创意工作者是直接利好,提示跟随的改进能减少反复调参的烦恼,建议有 AI 绘图需求的用户第一时间体验。原文稍后读已读值得跟进有用关注 Midjourney