deepseek·general

DeepSeek

别名
首次出现
2026-05-22
最近出现
2026-07-25
累计提及
1391
§ 01综述

DeepSeek 是一家中国人工智能公司,专注于开发高性能大语言模型,其近期发布的 V4 版本因在推理效率上的突破及巨额融资成为行业焦点。

DeepSeek 近期进展

  • 与 NVIDIA 深度合作优化推理性能:SGLang 联合 NVIDIA 对 DeepSeek V4 在 Blackwell 架构上进行了专项优化,实现推理性能 5 倍提升,单 Token 成本降至原本的五分之一,吞吐量提升 20 倍。原文标题
  • 完成 70 亿美元融资:DeepSeek 获得 70 亿美元新一轮融资,创下中国 AI 领域单轮融资纪录,资金将主要用于扩充国内算力基础设施。原文标题
  • 开源模型受益于企业 AI 开支收紧:瑞银报告指出,约六成企业正在收紧 AI 预算,低成本、可控的开源模型如 DeepSeek 成为更多企业的选择,市场份额有望提升。原文标题
  • 当前焦点与观察点

    DeepSeek 当前的核心优势在于将顶尖模型性能与开源策略结合,通过工程优化(如与 NVIDIA 合作)大幅降低部署成本。然而,其巨额融资和快速迭代也引发了关于可持续性和市场竞争的讨论。在 AI 行业整体向效率回归的背景下,DeepSeek 能否持续保持技术领先并扩大生态影响力,将是未来一段时间的观察重点。

    § 02相关报道10 条在档
    1. 01
      中国模型和开源模型在 OpenRouter 的 Token 使用量上占据绝对主导地位
      AI Will
    2. 02
      吴恩达开源桌面AI智能体OpenWorker,支持多模型和本地运行
      IT之家
    3. 03
      NVIDIA ModelExpress将DeepSeek-V4 Pro启动时间降至2分钟内
      NVIDIA AI
    4. 04
      小米新机入网备案文心一言、DeepSeek等多款大模型
      IT之家
    5. 05
      阿里云推出Token Plan,统一Qwen、Wan等多模型计费
      阿里云 Alibaba Cloud
    6. 06
      DeepSeek未支持多模态引发社区讨论
      宝玉
    7. 07
      Lean-QuantumAlg-Bench 和 Lean-QIT-Bench 评估 AI 定理证明
      arXiv: DeepSeek
    8. 08
      研究解耦代码模型表示中任务、语言与模型的作用
      arXiv: DeepSeek
    9. 09
      令牌预算饱和与思维链推理非收敛的早期机制检测
      arXiv: DeepSeek
    10. 10
      SLAI T-Rex在昇腾SuperPOD上对DeepSeek-V4家族进行全参数后训练
      AK
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/DeepSeek