#DeepSeek
GitHub 上全是 Jev 的衍生项目,疯都疯了。后面看哪家大模型,率先系统级组合 Jev 类似的功能,我希望这个模型是 DeepSeek-V4.2-Flash。Jev 当门卫,DeepSeek 当大脑或者 DeepSeek 出候选,Jev 做选择。DeepSeek 负责慢思考和文本生成,Jev 负责快决策和门控。
Bolt 上开源模型首周,开发者选最快 DeepSeek V4.1 Flash,该版本在 Bolt Forge 中上线,使用量是 DeepSeek V4 Pro 的 10 倍。
DeepSeek 新发布的 V4.1-Flash 技术报告,优化了预填充计算、HBM 缓存、SSD/主机持久化缓存和缓存失效恢复,还用了近似的 SWA Bounded Replay 替代长期保存局部缓存状态。
DeepSeek 新出的 V4.1-Flash 模型,KV 缓存占用比之前版本小很多,适合做长上下文对话,比如百万级文本的对话,而且性能还更好。
DeepSeek 新出的 CoAtNet-DeepMoE 模型,用混合专家技术把参数量从几百万降到两百万左右,同时保持高准确率,对做农业病害识别的应该有用。
朋友,有个网友用 DeepSeek V4.1 Flash 模型和 Hermes Agent 工具,把《生化危机 7》手游优化了,帧率提升 50%,在骁龙 8 Gen 2 手机上也能流畅跑了。
DeepSeek 的核心开发者自己说 AI 会取代他,这比任何公司宣传都更真实,值得看看他为什么这么想。
DeepSWE测试发现DeepSeek V4.1-Flash的输入token消耗远高于输出,缓存命中率高,能大幅降低成本。
DeepSeek Harness 开源了桌面客户端,界面和 Web 端一样,但运行方式更本地化,适合不想用网页版的人。
DeepSeek 的工程师们优化了他们的 V4-Flash 模型,让它跑在 AMD 的 GPU 上更快了,解码速度提升明显。
DeepSeek新发布的V4.1-Flash (Max)模型,任务成本比之前低,性能还提升了4.87%,在性能和成本上都有优势。
DeepSeek 新出的 V4.1-Flash (Max) 模型在 Agent Arena 排名第三,成本还特别低,适合做任务。
Bolt Forge 推出 GLM、DeepSeek、Kimi,提供 50 倍使用量,让开发者有更多机会测试和构建应用。新功能免费使用至 10 月 14 日,零使用费。
朋友录的播客,周一摸鱼时可以听,内容有 GPT-6、DeepSeek V4.1 和苹果的 iPhone Duo 这些热点。
DeepSeek 新模型的技术报告里,专门分析不同编码框架对模型性能的影响,比如极简的 mini-SWE 反而比 Claude Code 表现好,这个细节挺有意思。
DeepSeek 新模型 V4.1 Flash 性价比很高,在 OpenRouter 上 24 小时处理 1T token,比 GLM-5.3 Flash 便宜 5 倍。