6月19日
11:15
11:15官方账号arXiv cs.AI@Jinghong Lan, Wei Cheng, Yunuo Chen, Ziqi Ye, Peng Xing, Yixiao Fang, Rui Wang, Yufeng Yang, Xuanyang Zhang, Xianfang Zeng, Difan Zou, Gang Yu, Chi Zhang
FreeStyle提出一种基于社区LoRA挖掘的可扩展双参考生成框架,利用社区LoRA作为风格和内容的组合锚点,构建大规模三元组数据(风格参考和内容参考)。采用两阶段课程,包括注意力级富集约束抑制风格参考泄漏,以及频率感知RoPE调制解决位置对应泄漏。引入新基准,包含风格不变内容对齐分数(CAS)和基于VLM的拒绝分数。实验表明,FreeStyle在风格对齐、内容保持和泄漏抑制之间取得强平衡。
推荐理由:想同时控制图片风格和内容?FreeStyle用社区LoRA搞定双参考生成,还自带防泄漏机制,比以往方法更稳。
6月17日
00:10
00:10Justine Moore@venturetwins
Ideogram 发布了名为 Ideogram 2.0 的开源权重图像模型,宣称在开放权重类别中排名第一。该模型体积足够小,可在消费级 GPU 上运行,但在设计任务上与 Nano Banana 和 GPT Image 竞争。研究团队由 @mo_norouzi 领导,分享了技术细节和观点。
推荐理由:Ideogram 这个开源权重图像模型能在普通显卡上跑,还能和 GPT Image 掰手腕,适合不想烧钱又想要好效果的人。
6月12日
19:43
13:28
13:28官方账号Microsoft AI@MicrosoftAI
微软发布了其图像生成与编辑模型MAI-Image-2.5,该模型能够生成高度逼真的照片级图像,并支持精确编辑。一个有趣的细节是,其官方宣传图全部由模型本身生成,展示了其在细节和真实感上的强大能力。用户现在可以在微软Playground或OpenRouter上免费试用该模型。

推荐理由:微软MAI-Image-2.5在照片级真实感和精确编辑上表现出色,做设计、内容创作或AI图像研究的团队值得一试,直接在Playground或OpenRouter上体验其生成效果。
01:50
01:50Ideogram@ideogram_ai
Ideogram 4.0 是 Ideogram 首个开放权重的模型,发布一周后,开源和创意社区已经用它做出了超出预期的应用。JSON 和边界框提示(bounding box prompting)正在成为新的标准用法。官方在推文中汇总了第一周的社区亮点,展示了模型在可控生成和结构化提示方面的潜力。
事件专题

推荐理由:开源图像生成模型终于有了更可控的提示方式——JSON 和边界框让精确布局成为可能,做 AI 绘画工具或创意生成的开发者值得关注社区玩法。
6月11日
13:19
13:19官方账号Midjourney@midjourney
72°
Midjourney 宣布 V8.1 成为所有用户的默认模型,V8 将在两周后退役。V8.1 恢复了标志性美学,支持原生 2K 高清渲染,速度比 V8 快 3 倍,成本降低 3 倍。全质量 1K 模式比 V7 草稿模式更快。图像提示功能回归,新的“Describe”功能上线,并引入了 moodboards 和 srefs。V8.2 测试即将开始。
推荐理由:Midjourney 用户终于等来了更快的生成速度和更低成本,V8.1 的 2K 渲染和图像提示回归让创作更高效,建议立即体验新默认模型。
12:14
12:14官方一手Midjourney: Updates@Caleb
精选
Midjourney 已将默认模型从 V7 更新为 V8.1,基于用户测试和反馈。V8.1 模型更智能、更连贯,能更好地遵循详细提示,文字渲染效果也显著提升。启用 HD 模式后,图像质量进一步优化。这一更新意味着所有用户将默认使用更强大的生成能力,无需手动切换。
推荐理由:Midjourney 用户现在默认就能用上更智能、更听话的 V8.1,文字渲染和细节遵循能力大幅提升,做设计或内容创作的建议直接试试 HD 模式。
6月10日
6月9日
02:22
02:22官方账号Decoder@Jonathan Kemper
精选72°
微软研究院推出Lens,一个仅3.8B参数的文本到图像模型,在基准测试中匹配更大模型,训练成本大幅降低。其关键创新是使用GPT-4.1生成的8亿条详细图像描述,而非模糊的网页替代文本。代码和权重已开源。这表明高质量标注比模型规模更重要。

推荐理由:做图像生成模型训练或研究的团队,可以借鉴Lens用详细标注替代规模扩张的思路,直接复用其开源代码和权重,能大幅降低训练成本。
6月7日
6月6日
03:03
03:03Ideogram@ideogram_ai
Ideogram 宣布其最新开源图像模型为目前最佳的开源权重模型,参数规模达 9.3B,性能已接近闭源基础模型。该模型尚未达到扩展极限,团队预期随着规模扩大将进一步提升。此举缩小了开源与闭源图像生成模型之间的差距,为开发者提供了更强大的免费替代方案。

推荐理由:开源图像生成终于有了能打的大模型——9.3B 参数逼近闭源水平,做 AI 图像应用或研究的团队可以直接拿来用,值得关注后续扩展潜力。
03:02
03:02官方账号Together AI@togethercompute
Together AI 宣布推出 Ideogram 4,一款专为设计场景打造的开源图像模型。该模型具备强大的文字渲染能力、布局控制功能,并原生支持 2K 图像生成。AI 原生用户现可通过 Together Serverless Inference 在创意生产工作流中使用 Ideogram 4。这一发布为设计师和开发者提供了更可控、高质量的开源图像生成方案。

推荐理由:做设计或创意生产的团队终于有了开源的高质量图像模型——Ideogram 4 的文字渲染和布局控制解决了 AI 图像生成的常见痛点,建议设计师和 AI 开发者直接上手试试。
6月5日
6月4日