DeepSeek 说他们要继续提供 V4 Pro 的 API 服务,下线时间推迟了,计费方式还是老样子,对用 V4 Pro 的用户来说是个好消息。
#DeepSeek
DeepSeek 直接把自家旗舰 V4 Pro 下线了,换成 V4.1 Flash,说明新模型确实更强,对开发者来说,用 V4.1 Flash 能省不少钱,尤其是处理长上下文和频繁调用的时候。
DeepSeek 新出的 V4.1-Flash 模型,现在可以直接在 Ollama 云端用了,比之前的 DeepSeek 模型好用、快、便宜。
Anthropic 这份报告太有意思了,讲的是俄间谍、中国黑客、骗子都在用 Claude 做坏事,比如写导弹制导软件、造新闻。更搞笑的是,阿里、月之暗面、DeepSeek、智谱、小米这些大厂,用户以为在用自家模型,结果后台偷偷跑的是 Claude,批量偷 Claude 的答案去训练自己的模型。
DeepSeek 推出了 V4.1 Flash,性能接近 GPT-5.6,但成本只有 1/30,用 15 美元就能跑 100 个复杂任务,性价比很高。
寒武纪搞了个新东西,叫 Day-0,能让 DeepSeek-V4.1-Flash 模型直接在他们的芯片上跑,不用额外优化,挺厉害的。
DeepSeek 新出的 V4.1 Flash 模型,用不对称 MoE 架构,参数量 552B,但只用了 8B 活跃参数处理输入、16B 处理输出,比上一代节省了 3/4 的存储,算力效率更高,还支持多模态,价格也便宜,适合需要高效推理的场景。
DeepSeek 新出的 V4.1-Flash 模型,在 Ollama 云端上线了,比之前的小模型更智能、更快,还能处理图片,适合 Max 和 Team 帐户的用户。
DeepSeek 新发布的 V4.1 Flash 模型,推理速度更快,价格也降了 60%,比之前的 V4 Pro 强很多。
DeepSeek 新出的 V4.1 Flash 模型,用起来特别便宜,比 Sol 和 Opus 便宜50倍,性能还差不多,适合预算有限的人。
DeepSeek 新出的 V4.1 Flash 模型,性能不错,和 GLM-5.3 差不多,关键是内存消耗特别低,适合做 agentic 任务,价格也便宜很多。
DeepSeek 新发布的 V4.1 Flash 模型,比 V4-Pro 小三分之一,但在很多测试里还比它强,价格也便宜很多,值得看看。
DeepSeek 新出的 V4.1 Flash 模型,参数量 552B,用起来比上一代便宜很多,缓存需求也少,适合做 Agent 之类的任务。
DeepSeek 新发布的 552B 参数模型,架构更高效,成本更低,性能还比 DeepSeek-V4-Pro 更强。
DeepSeek 新发布的 V4.1 Flash 模型,规模更大,架构更先进,价格也调整了,原 V4 Pro 在 9 月 14 日就停用了,想试试的话可以看看。
DeepSeek 新出的 V4.1 Flash 模型,500B 参数就吊打 V4 Pro,还比 GPT 5.6 Sol 和 Opus 5 强,缓存还省四倍,性价比很高。
DeepSeek 更新了 Harness 工具,适配了最新的 V4.1 Flash 模型,还增加了文件处理和团队协作功能。