做自我进化 agent 的可以看看:不用改算法,套个统计检验就能让系统自己判断什么时候停止迭代,省 91.6% 的 token 还不掉点。
#DeepSeek V4 Flash
DeepSeek V4 Flash 加自改 harness,花 4 美元搜索就在 Terminal-Bench 上追平 Codex,SWE-bench 还省了近四成开销,做智能体的都该看看。
OpenCode Go 10更新,支持新模型GLM-5.3-Flash,但性能和价格不如DeepSeek V4 Flash。
看看 Claude Fable 5 在排版和色散处理上的优势,以及 Ox Alpha 模型的多模态和代码能力,和其它模型有何不同。
EvoX Genesis 用持久项目代替持久智能体,DeepSeek V4 Flash 花 44 美元写了能过测试的 C 编译器,MESA 提速 6.87 倍。
哥们儿用 Oh My Pi 把 VPS 和路由器的 Agent 全换了,Pi 就靠 read/bash/edit/write 四个内置工具干活,说个人场景很够用。
geekbb说V4 Flash找不到平替,就怕官方和OpenCode涨价。同用这个模型的话,你怎么看?
有人晒了 DeepSeek V4 Flash 在 DGX Station 上的实测数据,单机每秒能跑 1875 个 token,128k 上下文首字只要 5 秒,你可以拿这个数去衡量本地部署值不值。
想给 DeepSeek V4 Flash 配个编程智能体?Composio 实测了 4 个,Oh My Pi 成功率最高,OpenCode 最省钱,按需求挑。
实测四个框架,OpenCode每任务只要7美分,Claude Code要19美分但速度最快。想省钱选OpenCode,追求速度就选Claude Code。
刚拿下OpenRouter周榜第一的DeepSeek V4 Flash要最大幅涨价,官方提到成本压力,在用的人盯紧价格。
Bloomberg 的AI定价图居然把 DeepSeek 整个漏了。原来 V4 Flash 输入只要 $0.14/百万 token,便宜到放上去其它模型都没法看。
中国模型前五占四,DeepSeek V4 Flash一周跑7.1万亿token,OpenAI直接砍价80%,这仗打得真热闹。
geekbb 用 GPT 扩展配 DeepSeek V4 Flash 总结长帖,5 分钟变 1 分钟,1 分钟变 10 秒,适合懒人。
想白嫖DeepSeek V4 Flash?去北京或上海这家AGI Bar,连Wi-Fi就能免费调API,还能在Cursor里直接用,挺会玩。
DGX Spark用户别错过,一条命令跑284B的DeepSeek V4 Flash,prefill有1000 tok/s,多智能体也有59 tok/s。
哥们 Andrew Chen 晒了 DeepSeek V4 Flash 0731 跑在双 DGX Spark 上,想围观新版本性能的可以关注他。
这期播客聊了Kimi K3和DeepSeek V4 Flash,还有Anthropic翻车的事,听听Simon怎么评价开放权重和闭源模型的差距。
DeepSeek V4 Flash 在 Cola 上线了,免费就能玩,智能比 GLM 5.2 强,都快赶上 GPT 5.6 Luna了。
Fireworks给DeepSeek V4 Flash加了全套微调,监督、偏好、RL都能用,专为编码场景设计,快去试试。
Mozilla报告用数据告诉你开源模型有多猛:DeepSeek V4 Flash月用量18.4T Tokens碾压闭源,价格还暴跌50倍。