00:37Geek@geekbb精选一个名为 handoff 的开源工具让你在 Claude Code 或 Codex 会话中直接委托任务给 DeepSeek 等其他模型。典型用法是让 Claude 负责规划与审阅,DeepSeek 负责执行代码。这种方式能降低 API 成本,同时保持高开发效率。该方案已获得社区关注,相关仓库在 GitHub 上可见。技巧ClaudeDeepSeekClaude Code推荐理由:想省钱又能干活?让 Claude 当项目经理、DeepSeek 当写代码的,这个工具帮你搞定。原文稍后读已读值得跟进有用关注 Claude
22:03IT之家(博客/媒体)79°DeepSeek于本周完成首次外部融资,估值超过500亿美元(约3387.1亿元人民币)。公司一直拒绝外部融资,但在核心人才流失后启动融资计划。传闻创始人梁文锋向潜在资方提出承诺不挖走DeepSeek员工的要求。此前开发DeepSeek V3的罗福莉已转投小米,其团队推出的AI模型在基准测试中超越DeepSeek产品。行业DeepSeek融资人才流失推荐理由:DeepSeek首次外部融资估值惊人,还要求投资人别挖自己人,这人才战打得挺有意思。原文稍后读已读值得跟进有用关注 DeepSeek
15:52IT之家(博客/媒体)DeepSeek 识图模式已在网页和 App 端正式上线,App 端标注“图片理解功能内测中”,网页端无此提示。该模式与快速模式、专家模式并列,支持用户上传图片让 DeepSeek 解读。其能力不仅是文字提取,还能理解图像内容。背后的多模态模型技术已于今年 4 月公开,核心框架名为“Thinking with Visual Primitives”。AI产品DeepSeek识图模式多模态推荐理由:DeepSeek 现在能识图了,App 和网页都能用,不只是 OCR,还能理解画面,背后有专门的多模态技术。原文稍后读已读值得跟进有用关注 DeepSeek
09:21官方一手arXiv: DeepSeek@Yifu Ding, Jiacheng Wang, Ge Yang, Yongcheng Jing, Jinyang Guo, Xianglong Liu, Dacheng Tao精选该论文针对混合专家(MoE)模型部署时内存和推理开销大的问题,提出一种结构剪枝框架。方法将剪枝比率分配转化为通道分数覆盖最大化问题,通过归因近似高效求解。在DeepSeek和Qwen MoE模型上实验,结合4-bit量化后,50%或25%结构化剪枝仍保持模型准确率。在Qwen3-30B-A3B上,内存占用减少5.27倍,优于现有基线。论文MoE结构剪枝量化推荐理由:想省显存又怕掉精度?这篇论文用通道级剪枝加4-bit量化,把MoE模型体积砍到1/5还能保住性能,DeepSeek和Qwen都能用。原文稍后读已读值得跟进有用关注 MoE
08:03IT之家(博客/媒体)DeepSeek于6月16日完成首轮外部融资,整体规模约510亿元,企业估值近4000亿元。投资方包括创始人梁文锋、腾讯、宁德时代、网易、京东、IDG资本及国家人工智能产业投资基金。融资将用于扩展AI基础设施、加强研发、员工股权激励及加快商业化进程。这是DeepSeek首次引入外部资本,估值在国内AI创业公司中处于领先水平。行业DeepSeek腾讯宁德时代推荐理由:DeepSeek拿了510亿,估值4000亿,腾讯、宁德时代都投了,AI赛道钱景真猛原文稍后读已读值得跟进有用关注 DeepSeek
00:35Geek@geekbb从2022年期待本地运行ChatGPT-3.5,到2026年DeepSeek、Qwen、GLM、Kimi每月发布旗舰模型。本地部署模型列表包括GLM-4、DeepSeek R1/V3、Qwen3、Kimi-K2、GPT-oss-120b、Qwen3.7-Plus、Kimi-K2.7、Deepseek-V4、GLM-5.2等九个版本。迭代速度远超预期,社区感叹没有尽头。行业DeepSeekQwenGLM推荐理由:这帖子把2022到2026国产模型进化史盘得清清楚楚,DeepSeek、Qwen、GLM、Kimi每月一个旗舰,本地部署清单都快十个版本了,AI发烧友必看。原文稍后读已读值得跟进有用关注 DeepSeek
23:33IT之家(博客/媒体)91°DeepSeek 于 2026 年 6 月 16 日完成首轮外部融资,融资规模约 510 亿元,企业估值近 4000 亿元。投资方包括创始人梁文锋、腾讯、宁德时代、网易、京东、Monolith 砺思资本、IDG 资本、正心谷投资、拾象科技以及国家人工智能产业投资基金。DeepSeek 成立于 2023 年 7 月 17 日,此前由母公司幻方量化全资支持,其量化业务巅峰期管理资产规模超 700 亿元。本轮融资将用于扩展 AI 基础设施、加强研发、员工股权激励及加快商业化。行业DeepSeek腾讯宁德时代推荐理由:DeepSeek 拿到 510 亿首轮融资,估值 4000 亿,腾讯、宁德时代、京东都投了,梁文锋亲自把关,五年锁定期只留长线资本。原文稍后读已读值得跟进有用关注 DeepSeek
09:55官方一手pandaily@contact@pandaily.com (Pandaily)76°DeepSeek完成首次外部融资,金额超过74亿美元(500亿元人民币)。本轮融资后公司估值突破500亿美元。融资结构特殊,投资者获得经济权益但无投票权。行业DeepSeek融资估值推荐理由:DeepSeek首轮融资就拿到超500亿美元估值,而且投资人不要投票权,挺有意思的。原文稍后读已读值得跟进有用关注 DeepSeek
09:31官方一手arXiv: DeepSeek@Esteban Schafir, Xu Zheng, Hojat Allah Salehi, Zhuomin Chen, Mo Sha, Wei Cheng, Dongsheng Luo精选DecoSearch是一个无需训练的Text-to-SQL框架,通过轻量级Schema Selector修剪数据库模式,LLM Judger判断查询是否需要分解为DAG子问题。在BIRD上达到70.53%执行准确率,在Spider上达88.31%,使用DeepSeek作为骨干模型,比训练无关基线消耗少一个数量级的token。该方法还可作为模型无关包装器,一致提升微调后的SQL生成骨干性能。AI模型DecoSearchDeepSeekText-to-SQL推荐理由:DecoSearch不用训练就能把自然语言转SQL,在BIRD和Spider上准确率分别超70%和88%,比同类方法省十倍token。想提升SQL生成效率可以看看。原文稍后读已读值得跟进有用关注 DecoSearch
09:31官方一手arXiv: DeepSeek@Siyue Chen, Yifu Guo, Yuquan Lu, Zishan Xu, Jiaye Lin, Jianbo Lin, Siyu Zhang, Cheng Yang, Junxin Li, Yujia Li, Yu Huo, Ruixuan Wang该论文提出了LLM代码推理的内部生命周期概念:模型先在早期层中酝酿答案,使其线性可解,然后在后期层分化为四种解析结果——已解析、过度处理、错误解析、未解析。研究对Qwen、Llama、DeepSeek三个架构的16个模型进行了6类代码推理任务的层析探针和上下文剥离解码(CSD)实验。结果显示已解析平均仅41.5%,且函数调用任务中,调用深度从1层增至3层时已解析率从61.1%骤降至2.5%。所有模型的酝酿持续时长稳定在24%-42%,但解析成功率随模型能力和规模变化。论文代码推理QwenLlama推荐理由:这篇论文用层析探针找到了LLM做代码推理时“酝酿”到“解析”的秘密,发现即便准确率相近,内部失败模式也截然不同,值得想理解推理本质的人读。原文稍后读已读值得跟进有用关注 代码推理
04:02Gary Marcus@GaryMarcus微软正在探索将DeepSeek作为Copilot Cowork的底层模型,替代OpenAI和Anthropic。同时Copilot Cowork转向基于使用量的定价模式,微软表示有用户每周执行数百个任务,成本可能非常高。这一举动被分析认为伤害了OpenAI和Anthropic的潜在IPO。事件涉及Jevons悖论,即效率提升可能导致总用量增加。行业微软DeepSeekOpenAI10 个信源在谈事件专题推荐理由:微软可能换掉OpenAI和Anthropic,改用DeepSeek给Copilot Cowork,还改了按用量收费。这事直接影响两家公司上市计划,值得关注。原文稍后读已读值得跟进有用关注 微软
03:38@koltregaskes@koltregaskesDeepSeek 4.1 版本预计于本周发布。该版本是 DeepSeek 系列的最新迭代,具体性能数据尚未公布。用户可关注官方渠道获取更新信息。AI模型DeepSeekDeepSeek 4.1模型发布推荐理由:DeepSeek 要发新版本了,听说这周就上线,看看有什么进步。原文稍后读已读值得跟进有用关注 DeepSeek
18:28官方账号Decoder@Jonathan Kemper73°中国AI初创公司DeepSeek在首次外部融资轮中筹集超过50亿人民币(约7.4亿美元),公司估值达到500亿美元。这是DeepSeek首次接受外部投资,此前主要依赖内部资金。该轮融资由多家机构参与,显示出市场对DeepSeek技术实力的认可。行业DeepSeek融资估值推荐理由:DeepSeek第一次拿外部钱,融了74亿美元,估值冲到500亿,看看这家中国AI新势力怎么做到。原文稍后读已读值得跟进有用关注 DeepSeek
16:29掘金本周最热@CodeSheep梁文锋在2002年以806分成为当地高考状元,考入浙江大学电子信息工程专业。2007年他在浙大攻读研究生,师从项志宇教授研究计算机视觉。2015年,他与同学创立幻方量化,管理资产规模一度突破千亿。2023年,他创立DeepSeek,推出R1模型引发全球关注。行业DeepSeek梁文锋幻方量化推荐理由:讲梁文锋从高考状元到量化天王再到DeepSeek的完整经历,里面他的一些思考挺有启发。原文稍后读已读值得跟进有用关注 DeepSeek
14:29IT之家(博客/媒体)DeepSeek完成超70亿美元(约474亿元人民币)融资,估值超过500亿美元,创中国AI行业单轮融资纪录。此轮融资采用特殊结构,投资者享有经济权益但无投票权,且面临五年锁定期,仅国家人工智能产业投资基金直接注资10亿元并获投票权。腾讯、宁德时代、京东、网易及IDG资本参与投资,其中腾讯拟投100亿元,宁德时代计划出资50亿元。DeepSeek凭借V3大模型与R1推理模型获得全球关注,成为中国AI标杆企业。行业DeepSeek腾讯宁德时代推荐理由:DeepSeek刚拿到超70亿美元投资,腾讯、宁德时代都掏钱了,但全都没有投票权。这一轮是中国AI最大单轮融资,说明资本对它的V3和R1模型信心爆棚。原文稍后读已读值得跟进有用关注 DeepSeek
11:56官方一手arXiv: DeepSeek@Yingnan Zhao, Razvan Bunescu, Ahmed Louri, Avinash Karanth, Ke Wang针对MoE模型(如Qwen、DeepSeek)推理中专家加载延迟高的问题,研究者分析了专家选择行为,发现相邻MoE层和连续解码token间专家请求存在强相关性。基于此提出ST-MoE,一个结合轻量级运行时预测机制与可重构硬件设计的专家预取框架。ST-MoE通过预取专家与计算重叠,显著提升推理性能并降低能耗,同时保持模型精度。实验在多种MoE模型和应用(语言理解、代码生成)上验证了有效性。论文MoEQwenDeepSeek推荐理由:这篇论文分析了Qwen、DeepSeek等MoE模型的专家加载瓶颈,用ST-MoE框架通过预取专家来加速推理,兼顾效率和精度,适合关注大模型推理优化的读者。原文稍后读已读值得跟进有用关注 MoE
10:47官方一手arXiv: DeepSeek@Haolong Qian, Xianliang Yang, Yinuo ma, Lirong Che, Feng Lu, Ye Guo, Lei Song, Jiang Bian, Chun Yuan论文在Qwen2.5、LLaMA-3和DeepSeek三个系列上发现:用小模型自身生成并通过拒绝采样选取的轨迹,比用更强Oracle模型精炼的高奖励数据,能更有效提升数学推理。Oracle精炼虽修复逻辑,但引入分布偏移,增加小模型适应成本,抵消了逻辑改进的收益。作者提出风格对齐精炼(Style-Aligned Refinement),保留小模型原生轨迹风格同时融入Oracle逻辑修复,降低适应成本并恢复下游效用。该发现挑战了数学推理蒸馏中依赖奖励模型分数选择数据的常规做法。论文Qwen2.5LLaMA-3DeepSeek推荐理由:这篇论文揭穿了一个直觉错误:你以为给小白模型喂“学霸笔记”能变强,结果效果还不如它自己瞎写的解题草稿。原因是学霸的思路和它不匹配,硬学反而费劲。原文稍后读已读值得跟进有用关注 Qwen2.5
11:12Geek@geekbb这是一个开源的 Windows 小工具,可以实时监控 DeepSeek API 的余额和用量。它通过调用 DeepSeek 官方 API 接口获取数据,并在本地展示剩余额度。工具适用于需要管理 DeepSeek 账户 API 消耗的用户。GitHub 上提供了安装和使用说明。AI产品DeepSeekAPI余额监控推荐理由:能实时看 DeepSeek API 余额原文稍后读已读值得跟进有用关注 DeepSeek
10:20向阳乔木@vista8精选该工具输入任意App名称即可自动抓取AppStore用户评价,并通过DeepSeek进行四类信息挖掘:用户正面/负面评价、问题与版本更新的关联、产品机会识别、可视化图表输出。产品预计下周开源,可帮助产品经理快速从评论中提取 actionable 信息。技巧DeepSeekAppStore产品经理推荐理由:帮你用DeepSeek挖掘AppStore评论,找出产品机会原文稍后读已读值得跟进有用关注 DeepSeek
13:21IT之家(博客/媒体)小米新媒体高级工程师@小米_邹師傅发文评论某大模型重新出山,表示技术竞争值得欢迎,但担忧对方可能采用刷榜、刷屏、捆绑国产算力与情怀的营销手段。他指出国内大模型圈已形成靠作品说话的氛围,如DeepSeek靠开源、MiMo靠论文、Qwen靠开发者口碑。他警告新选手若以饱和舆论轰炸入场,将污染技术赛道。小米此前已发布MiMo-V2.5系列模型并永久降价,最高降幅达99%。行业小米MiMoDeepSeek推荐理由:小米工程师谈大模型竞争,警惕营销战原文稍后读已读值得跟进有用关注 小米
09:52Geek@geekbb精选一个名为 Archify 的开源项目展示了通过 LLM(如 pi 和 DeepSeek)将自然语言描述转换为结构化 JSON,再经 Node.js 渲染器用纯几何算法生成 SVG 并注入自包含 HTML 的流程。该方法无需依赖任何生图模型,仅利用 LLM 的指令遵循能力即可实现从文本到矢量图形的转换。项目代码托管在 GitHub 上,提供了一种轻量级的 AI 绘图新思路。技巧DeepSeekpiArchify推荐理由:不用生图模型也能画图原文稍后读已读值得跟进有用关注 DeepSeek
15:57官方一手pandaily@contact@pandaily.com (Pandaily)五款中国AI助手——豆包、通义千问、DeepSeek、Kimi和联想天禧——在2026年世界杯预测中展开了一场非传统对决,各自被赋予独特的‘球迷人格’,结果差异巨大。豆包采用玄学预测,DeepSeek押注黑马,通义千问则依赖数据分析。这场实验展示了不同AI在预测任务中的风格差异,也揭示了AI在体育预测中的局限性和趣味性。AI产品豆包通义千问DeepSeek推荐理由:想看看AI怎么用不同风格预测世界杯?做体育数据分析或AI应用开发的团队,点开看看豆包的玄学、DeepSeek的黑马和通义千问的数据流,会有启发。原文稍后读已读值得跟进有用关注 豆包
12:38Dylan Patel (SemiAnalysis)@dylan522p该分析报告对 DeepSeek 推理系统在多种硬件平台上的性能进行了详细评估,包括 NVIDIA GB200 NVL72、Blackwell、AMD MI355X 以及华为的芯片。报告还提供了过去 44 天内每日性能随时间变化的追踪数据。这些数据对于理解不同硬件在 AI 推理任务中的实际表现和稳定性具有重要参考价值,尤其适合关注硬件选型和性能优化的 AI 工程师。行业DeepSeek推理性能GB200 NVL7210 个信源在谈事件专题推荐理由:这份 44 天的性能追踪数据对做 AI 推理部署的团队很有价值,能直观对比 NVIDIA、AMD 和华为硬件的实际表现,建议点开看具体趋势。原文稍后读已读值得跟进有用关注 DeepSeek
21:23IT之家(博客/媒体)DeepSeek 开放平台因缓存计费系统在 2026 年 5 月 13 日至 6 月 9 日期间出现数据错误,导致部分 API 用户计费受影响。DeepSeek 团队已自动将相应金额以赠金形式返还至用户账户,并优先从赠金账户扣款。用户可登录平台查看到账情况,DeepSeek 已就此事致歉。此前 DeepSeek 发布 V4 系列大模型并大幅降价,此次故障处理体现了其对用户权益的重视。AI产品DeepSeekAPI计费系统推荐理由:API 用户最怕计费出问题,DeepSeek 主动退款并优先扣赠金,做 AI 应用开发或调用 API 的团队可以放心继续使用,这种处理方式值得点赞。原文稍后读已读值得跟进有用关注 DeepSeek
17:17掘金本周最热@倔强的石头_魔珐星云通过自研参数流架构,将大模型从纯文本对话框解放出来,赋予其3D数字人具身交互能力。该方案实现端到端约500ms毫秒级响应,在百元级硬件上流畅运行,解决了传统云端视频流方案的高延迟、音画不同步和高成本问题。开发者仅需一个HTML文件即可集成DeepSeek等国产大模型与3D数字人,实现实时眼神交流、表情和肢体动作的交互体验。AI产品具身智能3D数字人DeepSeek推荐理由:做AI交互应用或数字人产品的开发者,可以用一个HTML文件让大模型拥有3D躯壳,交互延迟降到500ms,值得直接上手试。原文稍后读已读值得跟进有用关注 具身智能
14:15AI产品黄叔@PMbackttfuture针对Codex写作内容AI味重的问题,作者提出使用Skill功能在不同阶段指定不同模型(如GPT5.5与DeepSeek交互配合)来优化输出。通过将内容整理后交付给DeepSeek写作,再由Codex审查,显著改善了逐字稿质量。该方法在保持Codex性价比、推理和Agentic能力的同时,解决了其理工直男式的写作风格问题。AI产品CodexGPT5.5DeepSeek推荐理由:做内容创作的开发者终于不用在AI味和性价比之间二选一了——用Skill混合模型就能让Codex写出更自然的文本,建议试试这个组合策略。原文稍后读已读值得跟进有用关注 Codex
13:15宝玉@dotey精选DeepSeek 发布全球首个“Agent Harness 研究员”岗位,旨在将前沿模型能力转化为领先的 Agent 产品。该岗位负责 Harness 领域的前沿创新,包括上下文管理、长期记忆、Subagent 与 Multi-Agent、自进化 Agent 等。团队使命是“Model + Harness = Agent”,除模型本身外所有工作都属于 Harness 范畴。任职要求包括科研背景、全栈开发能力、Agent 重度使用经验,以及对 LLM 和 Agent 机制的深入理解。这一招聘标志着 Agent 基础设施研究正式成为独立岗位,对 Agent 开发者和研究者意义重大。行业DeepSeekAgent Harness招聘推荐理由:DeepSeek 把 Agent 基础设施研究独立成岗,做 Agent 开发的团队可以直接参考其职责定义,想入行 Agent 研究的也可以看看门槛和方向。原文稍后读已读值得跟进有用关注 DeepSeek
00:51向阳乔木@vista8作者对比Fable 5后强调大模型降价的重要性,称赞DeepSeek v4 flash极其便宜,每月翻译大量内容仅花费几十元。作者将自己的AI雷达Skill转化为网站,支持双语对照翻译和AI侧边栏对话。网站本周上线,输入DeepSeek API即可使用AI功能,同时支持人工点评。作者计划下周开源该项目。AI产品DeepSeekv4 flash开源/仓库推荐理由:DeepSeek v4 flash 的低成本让个人开发者也能轻松跑翻译和AI功能,做工具型产品的团队值得关注这个开源项目,可以直接用或参考。原文稍后读已读值得跟进有用关注 DeepSeek
10:29官方一手arXiv: DeepSeek@Jianguo Zhu精选研究者发现了一种针对检索增强生成(RAG)系统的新型间接提示注入攻击模式,称为DACSI(文档作者控制信号冒充)。攻击者通过编写看似元数据、来源或策略信号的文档文本,让模型误将其视为可信的控制指令,从而绕过安全边界。该攻击无需显式命令,利用RAG将用户查询、检索文档和系统标签混合到同一自然语言提示中的设计缺陷。在DeepSeek V4 Pro、Qwen3.5-397B等6种模型上的实验表明,该攻击在多数模型上有效,尤其在高易感性设置中。研究建议通过源/通道分离来缓解此类攻击。论文RAG提示注入安全攻击推荐理由:RAG系统开发者需要警惕这种低成本、隐蔽的间接注入方式——它不依赖命令,而是冒充元数据,做AI安全的团队建议仔细看论文中的缓解方案。原文稍后读已读值得跟进有用关注 RAG
09:53官方一手pandaily@contact@pandaily.com (Pandaily)DeepSeek 在 5 月录得 5.41 亿月访问量,继续稳居中国 AI 产品榜首。与此同时,百度在搜索、长内容及对话式 AI 领域的多个产品出现明显复苏迹象。这一数据表明中国 AI 市场竞争格局正在变化,DeepSeek 保持领先,而传统巨头百度正通过 AI 整合重新夺回用户。行业DeepSeek百度AI 产品推荐理由:中国 AI 产品月活排名洗牌,DeepSeek 持续领跑,百度 AI 产品回暖值得关注——做市场分析或关注国内 AI 竞争格局的读者可以点开看看具体数据。原文稍后读已读值得跟进有用关注 DeepSeek
09:52官方一手pandaily@contact@pandaily.com (Pandaily)宁德时代(CATL)已投资DeepSeek的首轮融资,标志着这家电池巨头正式进军AI领域。创始人曾毓群正将战略重心转向AI数据中心能源基础设施,已投入超过10亿美元用于AIDC(AI数据中心)相关投资。此举将电池制造与AI算力需求结合,为能源与AI的融合开辟新路径。行业宁德时代DeepSeekAI能源推荐理由:CATL投资DeepSeek意味着电池巨头开始押注AI能源基础设施,做AI基础设施或能源管理的从业者值得关注这一跨界动向。原文稍后读已读值得跟进有用关注 宁德时代
11:01IT之家(博客/媒体)根据OpenRouter最新数据,上周全球AI大模型总调用量达36.1万亿Token,中国以14.19万亿Token连续六周超越美国(3.2万亿Token),稳居全球首位。前四名均为国产模型:DeepSeek-V4-Flash蝉联榜首,腾讯Hy3 preview第二,新发布的MiniMaxM3首周冲入前三,小米MiMo-V2.5第四。Claude系列跌出前五,显示国产模型在调用量上已形成明显优势。行业AI大模型调用量DeepSeek1 个信源在谈事件专题推荐理由:国产大模型在调用量上持续碾压美国,做模型选型或关注AI生态的开发者值得关注这一趋势,直接反映市场真实需求。原文稍后读已读值得跟进有用关注 AI大模型
22:44IT之家(博客/媒体)华为云推出面向Agentic AI时代的新云入口“智果园”,集成了云码道CodeArts代码智能体、OfficeAce办公智能体和WorkAgent文档智能体。该平台支持一键调用DeepSeek-V4-Pro、智谱GLM-5.1、月之暗面Kimi-K2.6和千问Qwen-Image等主流大模型,并推出Token Plan订阅计划。此外,智果园还涵盖智慧医疗、具身智能等AI梦工厂,旨在为开发者和企业提供统一的智能体开发与使用环境。AI产品华为云智果园智能体2 个信源在谈事件专题推荐理由:华为云把主流模型和智能体工具整合到一个入口,做AI应用开发或办公自动化的团队可以直接用,省去多平台切换的麻烦。原文稍后读已读值得跟进有用关注 华为云
16:30IT之家(博客/媒体)美国企业AI投入突破1万亿美元,但模型推理成本持续上涨,降本增效未达预期。Ramp报告显示,DeepSeek首次登上企业软件趋势榜榜首,成为增长最快的供应商。某企业一个月为Claude支付5亿美元,Uber四个月耗尽全年Token预算。DeepSeek宣布API价格永久下调75%,性价比成为进军全球B2B市场的主要武器。Ramp首席经济学家指出,这是美国企业主动寻找OpenAI、Anthropic低成本替代方案的明确信号。行业DeepSeekAI成本B2B市场10 个信源在谈事件专题推荐理由:AI成本失控让美国企业转向中国模型,DeepSeek的降价策略直接击中痛点,做企业采购或AI预算管理的团队值得关注这个趋势。原文稍后读已读值得跟进有用关注 DeepSeek
19:26官方账号SiliconFlowAI@siliconflowaiDeepSeek 在 OpenRouter 平台上的 Token 使用量连续四周排名第一,显示出其模型在开发者社区中的广泛采用。SiliconFlow 宣布为这一份额提供重要支持,并提供了完整的 DeepSeek 模型系列,包括 V4 Pro、Flash、V3.2 等,其中 V4 Pro 和 Flash 以最佳性价比著称。这一趋势反映了 DeepSeek 在开源模型领域的竞争力,尤其是在推理和编程任务上的表现。AI模型DeepSeekOpenRouterToken 份额推荐理由:DeepSeek 连续四周霸榜 OpenRouter Token 份额,说明开发者正在大量使用其模型做推理和编程。如果你在找性价比高的开源模型,SiliconFlow 上 V4 Pro 和 Flash 值得试试。原文稍后读已读值得跟进有用关注 DeepSeek
12:07官方账号arXiv cs.AI@Jui-Hui Chung, Ziyang Cai, Zihao Li, Qishuo Yin, Rohit Agarwal, Simon Park, Rodrigo Porto, Narutatsu Ri, Ziran Yang, Shange Tang, Xingyu Dang, Hongzhou Lin, Mengdi Wang, Danqi Chen, Chi Jin, Liam H Fowl, Sanjeev Arora精选83°Goedel-Architect 是一个基于 Lean 4 的智能体框架,通过生成和精炼“蓝图”(定义和引理的依赖图)来简化形式化定理证明。它先根据自然语言证明生成蓝图,然后并行证明每个引理节点,失败节点会驱动全局蓝图精炼,避免了传统递归分解的低效循环。使用开源模型 DeepSeek-V4-Flash 作为骨干,在 MiniF2F-test 上达到 99.2% pass@1,在 PutnamBench 上达到 75.6% pass@1。结合自然语言证明引导,可解决更难的题目,如 IMO 2025 的 4/6 和 Putnam 2025 的 11/12。该框架在开源管道中实现了最先进性能,且成本比同类开源方案低 500 倍。论文定理证明Lean 4蓝图生成1 个信源在谈事件专题推荐理由:形式化定理证明一直门槛高、成本高,Goedel-Architect 用蓝图+精炼策略大幅提升效率,做数学证明或形式化验证的团队值得关注,开源且成本极低。原文稍后读已读值得跟进有用关注 定理证明
15:49官方一手pandaily@contact@pandaily.com (Pandaily)DeepSeek 正在进行一轮约 500 亿人民币(约 69 亿美元)的融资,估值在 3500 亿至 4000 亿人民币之间(约 480-550 亿美元)。这标志着这家以成本高效大模型闻名的中国 AI 实验室首次大规模引入外部资本,此前它一直是最后一家没有外部融资的主要 AI 公司。该轮融资是 AI 历史上最大的私募融资之一,表明 DeepSeek 正从纯研究导向转向商业化,并开始探索消费者端变现。此举也反映了中国 AI 赛道资本竞争的加剧,以及投资者对高效模型商业前景的认可。行业DeepSeek融资大模型推荐理由:DeepSeek 从「不融资」到「天价融资」的转变,意味着中国 AI 竞争进入新阶段——做模型的人要关注资本如何重塑技术路线,投资者则要评估 500 亿美元估值是否合理。建议点开看融资细节和商业化信号。原文稍后读已读值得跟进有用关注 DeepSeek
12:43IT之家(博客/媒体)中国 AI 初创公司 DeepSeek 计划在首轮融资中筹集约 500 亿元人民币,投后估值在 3500 亿至 4000 亿元之间。创始人梁文峰自掏腰包 200 亿元,腾讯拟投资 100 亿元,宁德时代出资 50 亿元,成为最大外部投资者。网易、京东等也在洽谈中,投资方总数预计不足十家。此次融资凸显中国正全力打造从基础大模型到算力能源基建的全链条 AI 产业。DeepSeek 凭借 V3 和 R1 模型此前已获广泛好评,本轮融资预计两周内完成。行业DeepSeek融资腾讯推荐理由:DeepSeek 首轮融资规模惊人,腾讯和宁德时代入局说明 AI 赛道正吸引产业资本深度绑定。关注大模型投资动向的从业者和投资人值得细看,这轮融资可能重塑国内 AI 竞争格局。原文稍后读已读值得跟进有用关注 DeepSeek
11:49Geek@geekbb精选Ore Code 是一款专为 DeepSeek 设计的桌面端 AI 编码工作台,支持 macOS 和 Windows。它聚焦长上下文编码、结构化工具调用、本地项目上下文理解,并集成了 MCP 协议、技能和自动化功能。该项目已在 GitHub 开源,旨在为开发者提供更高效的 AI 辅助编程体验。AI产品DeepSeek桌面端AI 编码工作台4 个信源在谈事件专题推荐理由:如果你在用 DeepSeek 做编码,Ore Code 把长上下文、工具调用和项目上下文整合到了桌面端,省去来回切换的麻烦,做 AI 编程的开发者可以直接下载试试。原文稍后读已读值得跟进有用关注 DeepSeek
12:05官方一手arXiv: DeepSeek@Jiashen Huang, Yu Jia, Xu Pan一项针对405名中国用户的研究发现,对国内机构的信任显著影响用户对国产AI模型(如DeepSeek)的信任,而对ChatGPT等全球模型的影响较弱。研究提出“机构棱镜”框架,认为AI信任不仅是技术性能的反映,更是机构信任的折射。高机构信任增强用户对国产AI的情感信任,并使其认知评价更积极;低机构信任则削弱这一优势。该研究揭示了宏观治理与微观心理在AI信任形成中的关联,为理解不同国家AI信任差异提供了新视角。论文机构信任AI信任DeepSeek推荐理由:做AI产品出海或研究人机信任的团队,这篇论文揭示了机构信任如何成为AI采纳的关键变量——理解这一点,比单纯优化模型性能更能解释用户选择。建议点开看看框架和问卷设计。原文稍后读已读值得跟进有用关注 机构信任