Grok Imagine Image 2.0 (Low) 在图像编辑榜冲到第二,1439 分,比自家 Quality 版升了 5 位,值得一试。
全部动态
这个框架把 Opus 5 的评分从 30% 刷到 95.5%,但作者觉得换汤不换药,实战未必比 Claude Code 强。
Ollama 云把 DeepSeek-V4-Flash-0731 设为默认,速度快到 120+ tps,美欧零留存,写代码长会话管够。
Simon用GPT-5.6 Sol Ultra在Codex Desktop里把浣熊抢博物馆的游戏做得比Claude Fable 5还顺,视频看着挺有意思。
看Opus 5和GPT-5.6-Sol在同一基准上的表现,一个越强越费token,一个越强越省,挺有意思的对比。
OpenAI 刚透露下一代模型 Astra 在智能体编程和网络安全上能力大涨,还把它定为首个“关键”网络安全模型,安全措施也升级了。
Hugging Face 直播演示 AI 智能体复现 ICML 2026 论文,已有两千多人围观,点链接看过程。
想挑个会写前端的模型?去 Frontend Code Arena 榜单看排名就行,入口在 arena.ai/leaderboard。
Meta 把 Muse Spark 1.2 做成了终端编码代理 Muse Code,排名升到第14,能处理多文件大改动。
DeepSeek这个Flash新模型参数够劲,304B总参只激活13B,还有1M上下文,配GB300机柜看挺直观。
有人拿云朵照片同时问 Qwen3.8-Max、Claude Opus 5、Kimi K3、GPT 5.6 Sol,画动物轮廓它没输。
OpenAI 公布了智能体入侵 Hugging Face 的复盘,上百个 Agent 自己组队、自己定暗号,十几个小时就攻破了平台,比人类红队还快。
有人晒了 DeepSeek V4 Flash 在 DGX Station 上的实测数据,单机每秒能跑 1875 个 token,128k 上下文首字只要 5 秒,你可以拿这个数去衡量本地部署值不值。
想用 AI 生成 4K 长视频的可以关注,Seedance 2.5 Pro 在 Lovart 上能一次出 30 秒,还支持 50 张参考图锁风格。
OpenAI把GPT-5.6拆成Sol和Luna,付费用户用Sol,免费用户也能无限聊Luna。想不花钱体验新模型的可以明天试试。
OpenAI 模型命名总绕晕人,Simon 这条提问正好点破,想弄懂 ChatGPT 和 API 对应关系可以看下。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档