image·general

Image

别名
首次出现
2026-05-22
最近出现
2026-07-25
累计提及
434
§ 01综述

Image(图像生成模型)是当前AI领域最受关注的赛道之一,各大厂商密集发布新款模型,竞争日益白热化。从轻量级小模型到高分辨率输出,图像生成技术正向更高效、更智能的方向演进。

Image 模型近期进展

  • Google推出Nano Banana 2 Lite图像模型和Gemini Omni Flash视频模型:Google发布了轻量级图像模型Nano Banana 2 Lite,同时Gemini Omni Flash API进入预览阶段,支持视频编辑任务。这些模型强调在移动端和低算力环境下的高效推理能力。 Google推出Nano Banana 2 Lite图像模型和Gemini Omni Flash视频模型
  • Microsoft发布MAI-Image-2.5,文本到图像生成排名第二:Microsoft AI推出了MAI-Image-2.5模型,在ArtificialAnalysis的文本到图像基准测试中排名第二,图像编辑任务排名第三。该模型显示出微软在图像生成领域的持续投入。 Microsoft 推出 MAI-Image-2.5 模型,文本到图生成排名第2
  • 商汤推出U1 Pro图像思考模型,支持8K输出:商汤科技发布了U1 Pro图像思考模型,声称性能媲美GPT Image 2,并支持8K超高清输出,进一步推动了中国AI公司在图像生成领域的技术突破。 商汤发布U1 Pro图像思考模型,声称媲美GPT Image 2并支持8K输出
  • 安全自回归图像生成新方法提出:arXiv上出现一篇论文,提出基于迭代自改进码本的安全自回归图像生成方法,为生成模型的可控性和安全性提供了新思路。 Safe Autoregressive Image Generation with Iterative Self-Improving Codebooks 论文
  • 当前焦点与观察点

    当前Image领域的焦点集中在模型效率与输出质量的平衡上。一方面,轻量化模型如Nano Banana 2 Lite降低了部署门槛;另一方面,高分辨率支持(如8K)和复杂的图像编辑能力成为竞争新高地。此外,中国厂商(如商汤)与海外巨头(如Google、Microsoft)的差距在缩小,开源生态和成本优化(如使用替代模型降低87%成本)正在重塑产业格局。安全性问题(如自回归生成中的可控性)也开始受到更多关注,成为下一阶段的重要研究方向。
    § 02相关报道10 条在档
    1. 01
      ListenHub和Labnana上线Seedream 5.0 Pro,超越GPT Image 2
      orange.ai
    2. 02
      Runway Media Router 上线:按场景自动切换 AI 模型,省 Token
      IT之家
    3. 03
      微软发布MAI-Image-2.5-Pro与MAI-Voice-2-Flash模型,已落地Bing和PowerPoint
      IT之家
    4. 04
      微软MAI-Image-2.5-Pro和MAI-Voice-2-Flash上线OpenRouter
      OpenRouter
    5. 05
      MAI-Image-2.5-Pro 在 Foundry 发布预览版,专注高质量图像生成与编辑
      Mustafa Suleyman
    6. 06
      Microsoft MAI模型在PPT/OneDrive/Bing中部署,成本降84%延迟降25%
      Mustafa Suleyman
    7. 07
      Qwen-Image-3.0 发布:阿里第三代图像生成模型,支持4.5k tokens长提示和10px清晰文字
      阿里云 Alibaba Cloud
    8. 08
      Qwen-Image-3.0 发布,专注真实细节与深度知识
      阿里通义 Qwen
    9. 09
      Qwen-Image-3.0 发布,三代图像生成模型聚焦真实
      阿里通义 Qwen
    10. 10
      通义发布Qwen-Image-3.0,单指令生成九张信息图
      小互
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/Image