8月22日
20:58
20:58IT之家博客/媒体
DeepSeek 将于 2026 年 8 月 23 日起调整 API 计费规则,周六日全天统一按低谷价收费。调整距离峰谷定价机制实施仅一周。新的周末计费规则简化了计费逻辑,开发者可享受低谷时段价格。以 DeepSeek-V4-Pro 为例,高峰时段每百万 tokens 输出价格为 27 元,空闲时段为 13.5 元。

推荐理由:DeepSeek 又调整了 API 计费规则,周末统一按低谷价收费,对开发者来说更实惠了。和之前的峰谷定价相比,这次调整更简单,价格也更优惠。
8月15日
13:59
13:59ollama@ollama
78°
Ollama 宣布 DeepSeek-V4-Pro(0813)已在云端全面上线,覆盖 Pro 和 Max 订阅用户。用户可通过 ollama run deepseek-v4-pro:cloud 命令直接调用。该模型托管在美国,支持零数据保留(ZDR),强调数据隐私。Ollama 称其具备高性能,适合推理任务。
事件专题

推荐理由:Ollama 云端上线了 DeepSeek-V4-Pro,订阅 Pro/Max 就能直接用,美国节点还带零数据保留,要试的话一条命令就够。
8月13日
7月31日
16:47
16:47官方账号深度求索 DeepSeek@deepseek_ai
DeepSeek-V4-Flash-0731与预览版保持相同的模型架构和大小。本次升级只作用于DeepSeek-V4-Flash API,DeepSeek-V4-Pro API和App/Web端模型均未变化。DeepSeek官方表示,DeepSeek-V4-Pro正式版将尽快发布。
事件专题

推荐理由:DeepSeek刚更新了V4-Flash API到0731版,但架构和预览版一样,V4-Pro正式版马上就出,API开发者可以先升级试试。
7月30日
09:20
09:20官方一手arXiv: DeepSeek@Peiding Wang, Li Zhang, Fang Liu, Taichuan Li, Yinghao Zhu
CodeSpec提出双可执行规范方法,从子需求语义与仓库架构配对构建可靠功能链,并编译为互补的架构和行为规范。在FeatureBench上,使用DeepSeek-V4-Pro达到70.7%、55.0%和49.9%的通过率,优于Claude Code等基线。在NL2Repo-Bench上验证了泛化性。该方法通过可执行规范保证长周期开发中设计与实现的一致性。
事件专题

推荐理由:这篇论文搞了个CodeSpec,让代码智能体在仓库里加新功能时先建可执行规范,在FeatureBench上用DeepSeek-V4-Pro跑到70.7%通过率,比Claude Code靠谱不少。
7月19日
18:43
18:43官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云发布针对个人的Token Plan,统一积分支持文本、图像和视频生成。包含Qwen3.8-Max-Preview、GLM-5.2、DeepSeek-V4-Pro等模型,以及Happy Horse 1.1用于视频生成。首月优惠价仅4美元(使用优惠券后)。该计划提供多模态统一计费方式。
事件专题

推荐理由:阿里云新出的个人套餐,一个Token包圆文本、图像和视频,首月才4美元,性价比不错。
7月1日
6月2日
12:05
12:05官方一手arXiv: DeepSeek@Nahyun Lee, Dongkeun Yoon, Guijin Son, Geewook Kim, Dayoon Ko, Jeonghun Park, Haneul Yoo, Jaewon Cho, Junghun Park, Changyoon Lee, Kyochul Jang, Jaeyeon Kim, Eunsu Kim, Woojin Cho, Seungone Kim
K-BrowseComp 是一个专门针对韩语环境的网页浏览智能体基准测试,包含 400 个问题。其中 300 个问题由韩语母语者手工构建和验证,前沿模型如 GPT-5.5、DeepSeek-V4-Pro 和 GLM-5.1 在该子集上仅达到 30.00-45.67% 的准确率,远低于 BrowseComp 的表现。韩国本土大模型表现更差,仅 0.00-10.33%。研究还构建了 100 个合成问题作为压力测试,最强模型仅达 26.00%。该基准填补了韩语智能体评估的空白,揭示了当前模型在非英语环境下的显著短板。
事件专题

推荐理由:做多语言智能体或网页浏览任务的团队会立刻意识到差距——韩语场景下最强模型准确率不到一半,说明现有评估严重偏向英语。做韩语 NLP 或本地化产品的开发者可以直接用这个基准测试自己的模型。