#视觉生成
共 14 条 · 7 天 0 条 · 30 天 2 条
信息流里打上「视觉生成」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月2日
9月13日
9月9日
OpenRouter 默认使用 GPT-4o Image 2.5 Flare
OpenRouter 默认换成了 GPT-4o Image 2.5 Flare,专门做视觉内容创作和产品原型,比之前的更适合设计师和开发者。
8月11日
论文10:36
Open Evaluation Agent:高效可提示的视觉生成模型评估框架评估视觉生成模型不用再烧算力了,这个框架能把时间砍到十分之一,还支持自然语言定制评估,值得搞生成模型的人看看。
7月8日
7月7日
论文11:38
SearchGen-Bench揭示视觉生成模型世界知识瓶颈,协同训练框架提效想了解视觉生成模型为什么画不出新角色或近期事件?这篇论文用具体数据告诉你差距在哪,还给了个可复现的协作搜索方案。
7月3日
6月12日
Black Forest Labs 创始人斯坦福分享:从 GANs 到 FLUX 的视觉模型演进
Blatt 把视觉生成从 GANs 到 FLUX 的演进脉络讲透了,做图像生成或视觉 AI 的开发者能从中看到技术拐点,值得花 10 分钟听一下。
6月11日
6月10日
5月30日
5月29日
GPIC:28万亿像素的开放许可图像数据集,用于视觉生成
做视觉生成模型训练的研究者终于有了一个大规模、开放许可、可直接商用的数据集,不用再为版权和合规问题头疼。建议做图像生成、扩散模型或流匹配的团队直接下载使用。
5月26日
5月19日
SGT:用语义生成调优统一多模态模型的视觉理解与生成
做多模态模型训练的团队终于有了一个能同时提升理解和生成的后训练方法——SGT用分割任务对齐表征空间,比解耦训练更高效,做视觉AI的开发者可以直接参考代码实现。