全部动态
DeepSeek 正式版 V4 Flash 的 Agent 跑分全面超过 V4 Pro Preview,还支持 Codex API 格式,一键脚本就能接入。
Ollama云上线了DeepSeek-V4-Flash-0731,速度比昨天快2倍多,还能配合Claude Code用,可以试试。
DeepSeek的新模型前端代码拿了1586分,定价才0.14/0.28美元,同类里性价比最高,前端开发者可以试试。
Hermes agent看了条帖子就自动部署好DeepSeek v4 Flash,双DGX Sparks跑出82 tok/s,省人力还快。
哥们 Andrew Chen 晒了 DeepSeek V4 Flash 0731 跑在双 DGX Spark 上,想围观新版本性能的可以关注他。
想找能照着截图做网页的模型?直接看 Code Arena 这份榜单,Opus 5 (Max) 第一,GPT-5.6 和 Grok 的分数也都列出来了。
DeepSeek-V4-Flash-0731 上架 Ollama 云了,agent 能力更强,能直接配合 Claude Code 用,跑一条命令就能体验。
DeepSeek新出的V4-Flash能直接配Codex,一条命令搞定,跑分还反超自家V4-Pro,价格比Opus 4.8便宜89倍。
华为开源 openPangu-2.0-Pro(505B/512K,昇腾训练),但 GPQA 87.9 不如 Kimi K3。
DeepSeek-V4-Flash-High跑前端代码榜第7、开源第3,价格0.14美元/百万token,同级别性价比最高。
Hugging Face 免费开放了 DeepSeek-V4-Flash-0731 接口,无需 token,随手就能调,适合测试 agent 并行调用。
OpenAI 的 GPT-5.6 三兄弟开测,Sol 全栈第 3,Terra 和 Luna 也进 top20,挑模型看这个。
NVIDIA搞了个Spatial-IQ基准,把数箱子拆成九个子任务,Qwen2.5-VL练完后准确率从2.9%飙到62.6%,但离人类82.1%还远。
Thinking Machines 新出的 Inkling-Small 虽然没登顶,但官方给了它和头部模型的对比图,想了解它大概什么水平可看。
Inkling-Small只用12B激活参数就逼近DeepSeek V4 Flash,开放模型里排21名,少算力也能打,关注后续人投排名。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档