7月7日
11:38
11:38官方账号arXiv cs.AI@Haozhe Wang, Weijia Feng, Jinpeng Yu, Che Liu, Ping Nie, Fangzhen Lin, Jiaming Liu, Ruihua Huang, Jimmy Lin, Wenhu Chen, Cong Wei
本文提出SearchGen-20K数据集和SearchGen-Bench基准,包含20,839条提示,覆盖12类失败模式和22个领域。在SearchGen-Bench上,前沿开放视觉生成模型得分仅21-28分(满分100),比现有基准低40分。作者发现朴素搜索无效,会引入噪声,并识别出生成器特有的知识边界,提出"先教后搜"协同训练框架,即使最小版本也带来单调改进。
推荐理由:想了解视觉生成模型为什么画不出新角色或近期事件?这篇论文用具体数据告诉你差距在哪,还给了个可复现的协作搜索方案。
7月3日
5月29日
11:06
11:06官方账号arXiv cs.AI@Keshigeyan Chandrasegaran, Kyle Sargent, Suchir Agarwal, Michael Jang, Michael Poli, Juan Carlos Niebles, Justin Johnson, Jiajun Wu, Li Fei-Fei
精选72°
斯坦福大学发布GPIC(Giant Permissive Image Corpus),一个包含约28万亿像素、1亿训练样本的开放许可图像数据集。所有图像均采用宽松许可,可自由用于研究和商业用途,并经过安全过滤和去重处理。数据集托管在Hugging Face上,附带基准测试协议和像素空间流匹配的参考基线。这为视觉生成模型的可扩展研究提供了稳定、大规模且合规的数据基础。
推荐理由:做视觉生成模型训练的研究者终于有了一个大规模、开放许可、可直接商用的数据集,不用再为版权和合规问题头疼。建议做图像生成、扩散模型或流匹配的团队直接下载使用。
5月26日
19:00
19:00官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云在#DiveIntoYourWorld活动中展示了创作者利用AI构建的多个项目。这些项目涵盖了艺术、设计和交互体验,展示了AI在创意领域的应用潜力。活动旨在鼓励开发者探索AI与创意的结合,推动AI工具的普及。具体项目包括AI生成的视觉作品和互动装置,体现了AI如何赋能创作者。

推荐理由:对AI创意应用感兴趣的创作者和开发者,可以从中获取灵感,看看别人如何用阿里云AI工具做出有趣的项目,值得点开探索。