#多模态
共 1350 条 · 7 天 157 条 · 30 天 437 条 · 话题观测 →
8月21日
OenoBench:葡萄酒领域大模型评测基准
研究人员搞了个叫OenoBench的葡萄酒知识测试题库,用这个题库测了16个大模型,发现o3考得最好,DeepSeek R1在推理题上表现突出,还发现模型对自己出的题有偏好,挺有意思的。
产品09:36
OpenRouter 推出 FLUX Video Upscale 视频放大工具OpenRouter 刚刚发布了 FLUX Video Upscale,能放大视频,有 `precise` 和 `creative` 两种模式,一个快一个细节多。
OpenAI GPT-5.6 模型在 Amazon Bedrock 支持跨区域推理
AWS 在 Bedrock 上为 OpenAI GPT-5.6 模型增加了跨区域推理,能提升全球请求的吞吐量,适合需要低延迟和高可用性的开发者。
ChatGPT 新增 Computer History 功能
OpenAI 给 ChatGPT Pro、Business 和 Enterprise 用户上了个新功能,能让它记住你之前在电脑上干了啥,下次聊天不用再重复解释背景了。
产品00:53
bfl_ai 推出 FLUX Video Upscale 视频放大工具bfl_ai 刚刚发布了 FLUX Video Upscale,能把视频放大到 4K,还有个能重建细节的创意模式,比普通放大工具强多了。
8月20日
开发者用 ASCII 字符构建可自由探索的 3D 城市
Grow Now! Games 用 ASCII 字符做出了一个能自由探索的 3D 城市,没有 3D 模型,全靠自研引擎实现透视和碰撞,比普通 ASCII 画酷多了。
IT之家原文
阿里发布 Qwen-UI-Agent,主打让模型真正“会用”每一块屏幕
阿里刚发了 Qwen-UI-Agent,能直接操作手机电脑屏幕,移动端比 GPT-5.6 Sol 高 12 个点,还能在真实手机上跑任务,以后帮你自动查地址、订高铁、整理文件应该更靠谱了。
IT之家原文
8月19日