#DeepSeek V4
看看DeepSeek V4和Ox Alpha的价格战,Ox Alpha以更快的速度超越DeepSeek V4,显示出其性价比优势。
WorkBuddy能读聊天记录和飞书文档,自动出PPT大纲和成品,全程DeepSeek V4 flash,不到40积分,效率挺高。
Kimi K3和DeepSeek V4现在走了两条路:一个搞原生多模态,一个纯文本硬扛。长任务里能不能看懂画面,差距会越来越大。
这周模型圈太热闹了,DeepSeek V4、GLM 5.2 刚发,Kimi K3 和 Qwen 3.8 又来了,还有 Claude 和 GPT 对标,开源 SOTA 随时变天。
圈内多个模型传闻汇总:GPT-6 来势汹汹,Fable 5.1 几周内上线,DeepSeek 和 MiniMax 也在发力,值得关注。
DeepSeek V4的周Token量干到了6.6T,超过Anthropic,也甩开其他国产模型。想直观对比模型热度?OpenRouter这组数据很说明问题。
一条推文对比了普通人+DeepSeek V4和普通工程师不用AI,还有好工程师+Kimi 2.7 vs 普通工程师+Fable,直接说明AI能拉平技能差距。
SGLang 和 NVIDIA 联手让 DeepSeek V4 在 Blackwell 上跑得快了 5 倍,开源推理引擎的效率又上了一个台阶。
英伟达把 DeepSeek V4 的推理成本砍到五分之一,单 GPU 吞吐量暴增 20 倍,选 Blackwell 做推理的可以闭眼冲了。
Lindy、Cursor、Coinbase这些大厂都在把AI任务切到DeepSeek、Kimi、Qwen上,连微软都在测试DeepSeek V4,中国模型在西方变主流了。
这个基于DeepSeek V4的终端agent超省钱,修7个bug才1块零7分,比Claude Opus便宜30倍,编码体验还接近Claude Code。
OpenRouter晒出了GLM 5.2和DeepSeek V4的token份额对比,GLM 5.2涨得真快,开源模型里能跟DeepSeek掰手腕了。
Copilot Cowork 终于上线了,微软还打算用 DeepSeek V4 当廉价模型,按用量收费,做 Agent 的可以看看怎么降本。
微软嫌 Claude 和 GPT 太贵,打算用 DeepSeek V4 微调版,价格差了 57 倍,企业用户能省一大笔钱。
微软给Copilot Cowork换按用量计费了,还打算用DeepSeek V4省钱,这对企业用户成本影响挺大,值得关注。
终端编程助手 CodeWhale 结合 DeepSeek V4 的双模型配置,解决了编码中质量与速度的权衡问题,做 AI 编程的开发者可以直接在终端中体验自动路由和零漂移带来的稳定输出。
本地跑 DeepSeek V4 的 macOS 用户终于不用切终端了——菜单栏一键启停、看资源、开聊天,省掉繁琐操作,建议直接装来试试。
中国AI栈的崛起改变了全球竞争格局,做AI基础设施或模型开发的团队值得关注DeepSeek V4和华为SuperPoD的架构创新,这可能是降低对NVIDIA依赖的实用路径。
DeepSeek V4 适配华为昇腾解决了中国 AI 推理的芯片依赖问题,做国产化部署的团队可以直接用这套方案,建议关注后续性能评测。
CC Switch 解决了多 CLI 配置管理的碎片化问题,做 AI 编程或智能体开发的团队不用再手动切换环境变量,直接一键启用 SiliconFlow 预设就能用上 DeepSeek V4 等新模型,建议试试。
开源模型一个月内连发五款旗舰,做模型选型或研究的团队可以直接参考 CAISI 的 V4 评估对比,省去自己跑 benchmark 的时间。