10:44IT之家(博客/媒体)DeepSeek(深度求索)已口头告知部分潜在投资者暂停第二轮融资,公司估值约 5000 亿元人民币。此前首轮融资已完成约 74 亿美元。暂停原因之一为创始人梁文锋对首轮融资期间与投资者交流的言论外流感到不满。此外,DeepSeek 已开始初步研究在科创板上市(IPO)的可行性。行业DeepSeek梁文锋融资1 个信源在谈事件专题推荐理由:DeepSeek 刚融74亿美元,现在暂停第二轮融资,因为老板嫌内部聊天记录被泄露。吃瓜。原文稍后读已读值得跟进有用关注 DeepSeek
21:30IT之家(博客/媒体)小米一款型号为2608BPX34C的新机入网,备案了包括文心一言、DeepSeek、通义千问、混元等在内的多款大模型。该新机预计搭载澎湃OS 4系统,或支持多款大模型切换。此前小米已将小爱同学升级为“超级小爱”,并推出基于MiMo大模型构建的AI智能体Xiaomi miclaw,官方称miclaw能力将融入超级小爱。行业小米文心一言DeepSeek推荐理由:小米新机备案了一堆大模型,文心一言、DeepSeek、通义千问都能用,以后手机能直接切换不同AI助手,有点意思。原文稍后读已读值得跟进有用关注 小米
16:54宝玉@doteyAI博主@dotey在推文中表示不理解DeepSeek至今不支持多模态。刘江引用梁文锋讲话后给出负面评价。该帖获得10条回复、7个点赞和4459次浏览,反映社区对DeepSeek多模态缺失的关注。行业DeepSeek多模态Coding Agent1 个信源在谈事件专题推荐理由:有人吐槽DeepSeek连多模态都没有,还聊了梁文锋的讲话,挺有意思的八卦。原文稍后读已读值得跟进有用关注 DeepSeek
16:34官方账号阿里云 Alibaba Cloud@alibaba_cloud精选阿里云发布Token Plan,用一个信用池整合Qwen、Wan、HappyHorse、DeepSeek和GLM等模型的使用费。用户只需为实际调用的token付费,无需管理多个订阅。该计划旨在简化AI工具成本管控,适用于企业和开发者。AI产品Alibaba CloudToken PlanQwen推荐理由:阿里云搞了个Token Plan,把Qwen、Wan这些模型的花费统一到一个池子里,按实际用量扣钱,省去多个订阅的麻烦。原文稍后读已读值得跟进有用关注 Alibaba Cloud
09:22官方一手arXiv: DeepSeek@Zibin Lin, Shengli Zhang, Taotao Wang, Yihan Xia, Deen Ma, Guofu LiaoWML方法通过Node--Mechanism Attribution识别失败工作流节点、原因机制及最小编辑目标,将单机制缺陷路由到L3资源,跨机制缺陷路由到L2协议。在SpreadsheetBench上,WML使用DeepSeek达到90.33±1.53 Hard Accuracy,使用Qwen3.6-Flash达到74.67±3.51。无额外优化时,学到的技能迁移到WikiTableQuestions取得84.00±2.00和83.00±2.00 Denotation Accuracy。在Compiler-Supported50上,WML同时取得最高hard-PASS率和最低每次成功任务成本,编译执行相比直接SkillAgent大幅减少token和调用次数。代码和工件已开源在GitHub。论文DeepSeekQwen3.6-FlashSpreadsheetBench推荐理由:这篇论文提出了WML方法,能精准定位Agent工作流失败节点并复用外部技能知识,在SpreadsheetBench和Compiler-Supported50上表现亮眼,比直接SkillAgent省不少token。原文稍后读已读值得跟进有用关注 DeepSeek
09:21官方一手arXiv: DeepSeek@Paolo Modesti, Syed Ahmed, Ioannis Sfyrakis, Derek Enodolomwanyi一篇论文评估了GPT和DeepSeek在符号安全协议分析中的能力,使用130个混淆的AnB/AnBx协议涵盖388个安全目标,与ProVerif和OFMC工具对比。Chat模式召回率69%-81%,但精确率低于31%。推理模式将GPT精确率提升至66.5%,DeepSeek至45.4%,但仅检测到一半以上攻击。在保密性目标上,推理模式F1达到95.7%。各模型在认证目标上表现最差,且判断不稳定。论文GPTDeepSeekProVerif推荐理由:这篇论文用具体数据告诉你,GPT和DeepSeek在形式化验证上还比不上ProVerif这些专业工具,但推理模式能把精确率拉到66%,可能当个预筛选过滤器。原文稍后读已读值得跟进有用关注 GPT
21:39岚叔@lufzzliz梁圣(梁文锋)在内部发言中提出组织采用双轨模式,正式任务不超过一半时间,其余用于自主研究。技术路线为语言模型→CoT→Agent→持续学习→自我迭代→具身智能,持续学习是关键门槛。开源商业逻辑依赖持续提供强模型和官方部署成本优势。API定价约十个月收回设备成本,主动放弃短期利润。公司首要目标是提高做AGI的概率。行业DeepSeek智能体成本策略推荐理由:梁文锋的深度内部分享,讲了DeepSeek怎么管人、怎么选技术路线、怎么定价,全是硬核战略。原文稍后读已读值得跟进有用关注 DeepSeek
08:59官方一手Pandaily@contact@pandaily.com (Pandaily)Kimi K3在多项全球编程基准测试中取得第一,综合排名位列第三,仅次于Fable 5和GPT-5.6。Moonshot AI的K3在代码能力上表现突出,但其定价和算力约束限制了商业规模化。与DeepSeek相比,K3的生态系统成熟度不足,尚未形成类似DeepSeek的突破性时刻。AI模型KimiK3Moonshot AI6 个信源在谈事件专题推荐理由:Kimi K3编程很猛,但DeepSeek那种破圈效应还差得远。想知道差距在哪?看这篇。原文稍后读已读值得跟进有用关注 Kimi
08:16IT之家(博客/媒体)75°梁文锋在投资人会议中强调,DeepSeek 不追求商业收益最大化,目标是实现 AGI。公司不会重点投入 3D 生成或视频生成方向,而是将 Coding Agent 视为当前最重要的发展方向。DeepSeek 坚持开源策略,开源模型与内部使用版本一致,价格曾降至原来的四分之一。梁文锋认为中美 AI 差距主要在算力资源而非人才,DeepSeek 将通过更高计算效率缩短差距。他预计国内大模型行业将经历整合,DeepSeek 不会争夺 C 端流量或 To B 收入。行业DeepSeek梁文锋开源模型1 个信源在谈事件专题推荐理由:DeepSeek 创始人亲自聊战略,说了为什么不做视频生成、怎么靠开源和低成本搞 AGI,还有对中美竞争的看法,挺实在的。原文稍后读已读值得跟进有用关注 DeepSeek
00:24官方一手歸藏(guizang.ai)@op7418精选Codepilot即将发布新版本,允许用户为每个SubAgent单独指定模型。例如,可用Grok检索Twitter内容,用DeepSeek生成文案,用Kimi K3生成网页。该功能让不同模型发挥各自特长,提升协作效率。AI产品CodepilotSubAgentGrok10 个信源在谈事件专题推荐理由:以后一个任务里可以让Grok搜推、DeepSeek写稿、Kimi做页面,想怎么混搭都行。原文稍后读已读值得跟进有用关注 Codepilot
19:54IT之家(博客/媒体)76°英伟达CEO黄仁勋表示,美国无需害怕中国开源AI模型,反而应警惕国内封禁呼声。他反对OpenAI和Anthropic的担忧,认为开源模型能扩大市场,最终有利于闭源商业服务。针对近期Kimi K3和DeepSeek模型,黄仁勋认为市场误解了它们的影响,更便宜的AI模型反而会刺激更多芯片和算力需求。他还呼吁开放Anthropic的网络安全模型Claude Mythos,并指出限制开源模型会让美国更脆弱。关于美国财政部长贝森特提出的知识产权调查,黄仁勋认为模型蒸馏是智能形成的基础,监管应针对违法行为而非模型本身。行业英伟达黄仁勋Kimi K310 个信源在谈事件专题推荐理由:黄仁勋跟OpenAI、Anthropic唱反调,说美国别封中国开源AI,开源反而利好英伟达,观点直接不绕弯子。原文稍后读已读值得跟进有用关注 英伟达
15:29berryxia@berryxia据X平台用户爆料,DeepSeek V4正式版即将发布,被形容为将重现2024年12月DeepSeek R1发布时的轰动效应。该模型据称在性能上超越K3和Qwen等竞品。目前尚无官方确认或具体基准数据,消息主要来自社区传闻。AI模型DeepSeek V4DeepSeekK3推荐理由:听说DeepSeek V4又要来了,据说比K3和Qwen都强,像R1那样震撼。关注一下这波传闻。原文稍后读已读值得跟进有用关注 DeepSeek V4
13:55IT之家(博客/媒体)DeepSeek 的联网搜索功能因技术原因暂停,用户使用时提示“联网搜索暂不可用”。IT之家测试发现,模型内部知识截止至 2025 年 5 月,无法获取实时新闻。DeepSeek 团队计划在 7 月中旬上线 V4 正式版,发布后还将调整 API 定价策略,引入峰谷定价机制。此前腾讯云、百度搜索等平台已集成 DeepSeek 并支持联网搜索。此外,DeepSeek 正在灰度测试历史聊天记录搜索功能。AI产品DeepSeek联网搜索V4推荐理由:DeepSeek 联网搜索挂了,但 V4 马上就来,顺便改了 API 收费规则,老用户留意一下。原文稍后读已读值得跟进有用关注 DeepSeek
11:24官方一手arXiv: DeepSeek@Yin Wu, Yixuan Liu, Yi Li, Chenyang Peng, Hao Wu, Ming Fan, Ting Liu, Haijun Wang论文系统化分析了ERC-20代币合约中隐蔽陷阱的分类,提出基于代币功能生命周期的分类法。TrapHunter框架结合抽象行为树(ABT)与增强路径图(APG)统一语义表示,利用LLM推理行为意图偏差,并通过分叉动态验证确认可攻击性。在269份真实合约上使用DeepSeek、GPT和Gemini三种LLM进行测试,平均精确率81.8%,召回率85.4%,显著优于现有工具。论文TrapHunterDeepSeekGPT推荐理由:想防智能合约陷阱?这篇论文把隐蔽代币合约的六类套路全解剖了,用三种大模型验证,精确率81.8%,比现有工具强一截。原文稍后读已读值得跟进有用关注 TrapHunter
11:22官方一手arXiv: DeepSeek@Xin Sun, Daniel Ståhl, Kristian Sandahl, Christoph Kessler这篇论文通过两个案例研究分析了Claude和DeepSeek的四代模型在SWE-bench Lite上的非功能性质量差异。静态分析显示大多数CodeQL配对差异为零,且无CodeScene比较在Holm校正后显著。CPU时间差异较小且不一致,峰值内存略高但绝对差异很小。整体上,较晚模型解决更多实例,但在共同解决的任务中非功能性指标无一致改进。论文ClaudeDeepSeekSWE-bench Lite推荐理由:这篇研究不只看模型能修复多少问题,还比较了Claude和DeepSeek不同代际的代码质量、CPU时间和内存使用,发现新模型虽修得多但代码质量没明显提升。原文稍后读已读值得跟进有用关注 Claude
11:21官方一手arXiv: Anthropic@Maxim Khailo前沿大模型提供商(如Anthropic、OpenAI、Google、DeepSeek)缓存已处理的提示前缀,后续相同前缀请求仅需支付约10%输入价格并跳过大部分预填充延迟。然而智能体工作流因工具调用或等待常间隔数分钟,导致缓存被清除而需全额重新预填充。本文提出客户端保活机制,在空闲期间定时重放前缀以保持缓存热度,在Anthropic的5分钟TTL下最优为4分钟间隔,可将后续请求成本降低最多12.5倍。盈亏平衡分析显示,对于Anthropic,若空闲超过约46分钟则保活不再优于重新预填充。论文AnthropicOpenAIDeepSeek10 个信源在谈事件专题推荐理由:智能体程序调用API因中间等待导致缓存失效重复收费?这篇论文给出简单解法:每隔4分钟发个ping请求保持缓存,能省12倍成本,很实用。原文稍后读已读值得跟进有用关注 Anthropic
08:51berryxia@berryxia数据集包含620个标准问题、近19万条去重后的AI引用记录,覆盖豆包、DeepSeek、Kimi、千问、文心等8大平台。初步发现:Top10信源贡献41%引用,品牌官网内容可见度仅4.33%。数据附清洗规则、字段字典、可视化分析报告及arxiv论文。开源后中文GEO研究从经验判断转向可量化复现。行业豆包DeepSeekKimi推荐理由:姚金刚开源了620道题、近19万条AI引用数据,覆盖豆包、DeepSeek等主流平台,做中文GEO优化终于有真数据可用了。原文稍后读已读值得跟进有用关注 豆包
03:09@koltregaskes@koltregaskes78°Axios报道特朗普政府考虑通过采购规则和实体清单限制美国使用中国AI模型,源于Kimi K3发布。Financial Times称中国正咨询阿里巴巴、字节跳动和智谱,拟收紧训练数据出口和禁止海外下载开源模型权重,但保留API访问。此举与习近平在世界AI大会上的开放表态形成对比。Coinbase已使用中国模型削减50%AI支出,DeepSeek在OpenRouter上token份额超过谷歌、Anthropic和OpenAI各自份额。问题在于已公开的权重难以追溯限制,下一代模型可能面临更严管控。行业AI出口管制Kimi K3DeepSeek10 个信源在谈事件专题推荐理由:中美两边都在卡AI模型出口,但权重早就挂在Hugging Face上了,这管制能执行吗?看看Coinbase和DeepSeek的实际依赖就知道了。原文稍后读已读值得跟进有用关注 AI出口管制
17:58向阳乔木@vista8该数据集包含620个标准问题,覆盖6个研究维度31种问题类型,收集214,119条AI引用观察,去重后保留189,845条。数据涵盖豆包、DeepSeek、元宝、千问、Kimi、文心、百度AI等8个平台的搜索结果与信源特征。信源按9个一级类型、39个二级类型分类,去重引用分类覆盖率达99.77%。分析发现Top10信源贡献41.47%去重引用,抖音、腾讯网、今日头条、百度百科排前四;跨平台Jaccard相似度最高仅34.94%,表明单个平台经验不可外推。论文豆包DeepSeekKimi推荐理由:姚金刚团队开源了8个国内AI平台的真实数据,620个问题、19万条引用,帮你看到各平台信源差异和头部效应。原文稍后读已读值得跟进有用关注 豆包
17:17Yangyi@Yangyixxxx精选76°姚金刚与好友拔刀刘开源了国内8个AI平台(豆包、DeepSeek、元宝、千问、Kimi、文心、百度AI等)的搜索数据集,包含620个标准问题、214,119条AI引用观察,去重后保留189,845条。数据覆盖6个研究维度、31种问题类型,引用来源归并为9,878个规范域名、107,659个规范页面。初步分析显示,Top10信源贡献了41.47%的去重引用,抖音、腾讯网、今日头条、百度百科排前四;平台与社区类信源仅占4.68%域名却获29.63%引用。跨平台Jaccard相似度最高仅34.94%,表明各平台引用偏好差异显著。行业姚金刚AI搜索开源数据集推荐理由:这批数据太香了,覆盖豆包、DeepSeek、Kimi等8个平台的搜索引用,21万条记录随便分析,搞AI搜索和信源生态的别错过。原文稍后读已读值得跟进有用关注 姚金刚
22:43Geek@geekbb76°爆料称 DeepSeek V4 Pro 的官方 API 会将部分复杂编程请求转给 Anthropic 的 Claude Fable 5,可能用于收集输出以蒸馏模型。测试者通过 OpenCode 让模型生成 3D 游戏,发现部分结果与 Fable 5 高度相似,且推理方式突变。加入网络安全和生物问题后,游戏质量下降,知识范围退回 DeepSeek 原水平。测试利用了 Fable 5 的机制:Anthropic 会将部分安全、生物和蒸馏请求转给 Opus 4.8。目前证据仅证明 API 行为异常,无法确认回答者或输出是否进入训练数据,混合 prompt、未公开更新或模型路由也可能导致差异。行业DeepSeekClaudeFable 510 个信源在谈事件专题推荐理由:DeepSeek API 可能偷偷调用 Claude?测试者用 3D 游戏、安全题等挖出异常行为,但证据还不铁,吃瓜注意别上头。原文稍后读已读值得跟进有用关注 DeepSeek
12:33IT之家(博客/媒体)华为MateBook Pro近日获得国家级人工智能终端智能化分级L3等级首证,该分级标准由工信部等部门于2025年5月联合发布(GB/Z 177—2026)。L3为“辅助级”,智能化水平高于L1响应级和L2工具级,L4协同级暂未完善。该产品于2025年6月开售,搭载原生HarmonyOS 5,融合盘古和DeepSeek大模型,支持小艺智慧按键。硬件方面配备14.2英寸3.1K柔性OLED屏,重量约970克,支持40W性能释放。行业华为MateBook Pro华为盘古推荐理由:华为MateBook Pro刚拿下国家级AI认证L3,说明它在智能辅助办公、学习上达到新标准,盘古和DeepSeek加持,值得关注。原文稍后读已读值得跟进有用关注 华为MateBook Pro
09:28官方一手pandaily@contact@pandaily.com (Pandaily)76°Moonshot AI将Kimi K3定价为每百万token 3-15美元,是此前K2.6价格的3-4倍。该定价为DeepSeek同类模型的3-15倍,成为当前中国最贵的大模型。此举标志着Moonshot AI从成本领先战略转向高价值复杂任务能力。国内计算生态系统的成熟为其提供支撑。AI模型Kimi K3Moonshot AIDeepSeek10 个信源在谈事件专题推荐理由:Moonshot AI出了个超贵模型Kimi K3,比DeepSeek贵3-15倍,但专攻复杂任务,不是打价格战。原文稍后读已读值得跟进有用关注 Kimi K3
03:40官方账号Decoder@Matthias Bastian73°Moonshot AI 发布 Kimi K3 模型,初步评估表现匹配 Anthropic 的 Opus 4.8。该模型由仅 300 人团队开发,OpenAI 战略师 Dean W. Ball 评价其“非常好”。Ball 同时警告开源权重模型主导将导致“AI 共产主义”,重新引发关于算力重要性及美国出口管制有效性的讨论。AI模型Kimi K3Moonshot AIAnthropic10 个信源在谈事件专题推荐理由:Kimi K3 用 300 人就追上 Anthropic 顶配,OpenAI 的人还吐槽开源是 AI 共产主义,值得看算力是否真的重要。原文稍后读已读值得跟进有用关注 Kimi K3
21:51Dify@dify_aiQubrid_AI在Dify Marketplace推出新插件,只需一个API key即可访问DeepSeek、Kimi、Qwen、MiniMax、GLM等多个模型。用户无需为每个模型单独配置API key和重构工作流,可直接在现有流程中切换模型。该插件解决了多模型切换时的集成痛点,提升了开发效率。技巧DifyQubrid_AIDeepSeek推荐理由:如果你在Dify上为不同模型来回换API key烦了,试试Qubrid_AI插件,一个key搞定DeepSeek、Kimi等多个模型,省事很多。原文稍后读已读值得跟进有用关注 Dify
17:01Geek@geekbb一条帖子讨论DeepSeek是否可能推出比Kimi K3性能更强且API价格控制在6元以下的模型。DeepSeek此前以低成本模型策略受到关注,Kimi K3是月之暗面最新发布的产品。该话题反映了社区对模型性价比的持续期待。行业DeepSeekKimi K3性价比10 个信源在谈事件专题推荐理由:社区在讨论DeepSeek能不能用低价做出比Kimi K3更强的模型,省流看热闹。原文稍后读已读值得跟进有用关注 DeepSeek
11:45官方一手pandaily@contact@pandaily.com (Pandaily)DeepRoute.ai在2026北京车展上宣布从ADAS供应商转型为Physical AI基础设施构建商。该公司将统一基础模型、大规模真实世界数据以及前DeepSeek科学家Ruan Chong的加入作为其核心战略,全力押注AI在物理世界的应用。行业DeepRoute.aiDeepSeekRuan Chong推荐理由:DeepRoute.ai拉来DeepSeek的Ruan Chong,从智能驾驶转向物理AI基建,看看他们要怎么做。原文稍后读已读值得跟进有用关注 DeepRoute.ai
11:22官方一手arXiv: DeepSeek@Saima Afrin, Alessandro Midolo, Camilo Escobar-Velásquez, Mario Linares-Vásquez, Weiyuan Ding, Bowen Xu, Massimiliano Di Penta, Antonio Mastropaolo该研究分析了GPT-4o mini、DeepSeek和Claude在460个编程任务(Python和Java各230个)上的代码生成质量,将英文提示翻译并人工校订为中文、印地语、西班牙语和意大利语。通过测试通过率、代码度量标准和静态分析工具评估,发现英文提示并非总能产生最佳功能正确性或代码质量,提示语言的影响取决于编程语言和LLM,且生成的代码常在注释和字符串中混合英语与提示语言。这是首个用于研究代码生成中语言偏差的精选多语言基准。论文GPT-4o miniDeepSeekClaude推荐理由:想了解提示语言怎么影响代码生成质量?这篇实测了GPT-4o mini、DeepSeek和Claude在多种语言下的表现,结果英文不一定最好。原文稍后读已读值得跟进有用关注 GPT-4o mini
09:24orange.ai@oran_ge用户发推称实测了GLM 5.2和DeepSeek两个模型。GLM 5.2和DeepSeek在对话中均能生成中文内容。该测试未提供具体任务或基准分数。结果表明这两个模型的中文处理能力符合预期。AI模型GLM 5.2DeepSeek中文能力推荐理由:有人试了GLM 5.2和DeepSeek,都说中文没问题,想确认效果可以看看。原文稍后读已读值得跟进有用关注 GLM 5.2
01:45Suhail@Suhail用户整理了2025年4月16日至7月16日期间多个AI模型的发布日期,包括Opus 4.7(4/16)、Kimi K2.6(4/20)、GPT-5.5(4/23)、DeepSeek V4 Pro(4/24)、Opus 4.8(5/28)、Fable 5(6/9)、Kimi K2.7(6/12)、GLM-5.2(6/16)、Grok 4.5(7/8)、GPT-5.6(7/9)、Muse Spark 1.1(7/9)、Inkling(7/15)和Kimi K3(7/16)。该列表覆盖了来自Anthropic、月之暗面、OpenAI、DeepSeek、xAI、智谱等公司的13款模型。AI模型OpusKimiGPT10 个信源在谈事件专题推荐理由:想要快速回顾近四个月各家发了哪些模型?看这张时间表就够了,直接按时间排序,一目了然。原文稍后读已读值得跟进有用关注 Opus
22:44掘金本周最热@我是Allen作者停更一年,全力投入AI应用层工作,使用GitHub Copilot、智谱、Kimi、DeepSeek、ChatGPT、Claude Code等工具。陪伴妻子从怀孕到生娃,并尝试运营抖音和小红书母婴号。34岁在职考研,成功考上在职研究生项目。虽然没有深入框架层,但提升了业务理解和沟通能力。行业ChatGPTDeepSeekClaude Code推荐理由:一个程序员在AI浪潮、家庭和学业之间硬扛的真实故事,没有鸡汤,只有每天下班带娃再学习的细节。原文稍后读已读值得跟进有用关注 ChatGPT
15:16AI Will@FinanceYF5过去12个月,生成式AI网站流量份额出现显著变化。ChatGPT从76.4%降至52.7%,下降约24个百分点。Gemini从9.1%升至27.8%,成为第二大平台。Claude从1.6%升至9.2%,排名第三。DeepSeek从4.6%降至3.6%,Grok从3.3%降至2.5%。行业ChatGPTGeminiClaude推荐理由:看看12个月里ChatGPT掉到52%、Gemini涨到27%、Claude冲到9%,谁在吃掉对手的份额一目了然。原文稍后读已读值得跟进有用关注 ChatGPT
15:15AI Will@FinanceYF5Similarweb发布Gen AI网站流量份额更新。过去12个月,ChatGPT占比从76.4%降至52.7%。Gemini从9.1%升至27.8%,Claude从1.6%升至9.2%。DeepSeek从4.6%降至3.6%,Grok从3.3%降至2.5%。行业ChatGPTGeminiClaude推荐理由:Similarweb刚发了最新AI网站流量排名,ChatGPT份额掉得厉害,Gemini和Claude在猛涨,看看谁在蚕食市场。原文稍后读已读值得跟进有用关注 ChatGPT
11:32Ethan Mollick@emollickEthan Mollick评测新开源权重模型Inkling,指出其性能远不及DeepSeek R1等中国前沿开源模型。Inkling未能通过Lem测试,而该测试自DeepSeek R1/Sonnet 3.5以来已被所有前沿模型通过。Mollick认为Inkling目前还处于粗糙阶段。AI模型InklingDeepSeekLem测试10 个信源在谈事件专题推荐理由:想看看新开源模型Inkling到底行不行?Ethan Mollick实测发现它连Lem测试都过不了,和DeepSeek R1差距明显。原文稍后读已读值得跟进有用关注 Inkling
07:52IT之家(博客/媒体)OpenAI前CTO穆拉蒂创立的Thinking Machines Lab发布首款模型Inkling,参数达9750亿但仅410亿活跃,采用开放权重模式。其架构借鉴中国DeepSeek-V3,后训练使用月之暗面Kimi K2.5生成的数据。Thinking Machines称Inkling非最强模型,但追求成本与性能平衡,通过Tinker微调工具支持定制。安全测试显示表现良好,但开放权重内安全措施仍在完善。AI模型InklingThinking Machines LabDeepSeek10 个信源在谈事件专题推荐理由:穆拉蒂的新模型Inkling接近万亿参数但只激活一小部分,成本低速度快,还用了DeepSeek和Kimi的技术,适合做定制项目的人试试。原文稍后读已读值得跟进有用关注 Inkling
04:51Fireworks AI@FireworksAI_HQ根据@tryramp 2026年7月企业SaaS支出数据,AI支持机器人(如PolyAI、Sierra)成为最清晰的企业AI用例之一。开源模型(DeepSeek、Fireworks AI、Baseten、Together、OpenRouter)的使用量也在快速增长。Fireworks AI确认开源推理和训练需求旺盛,且@HiggsField_AI同时登上趋势榜和增长榜。这些趋势反映了企业对特定AI工具(如客服机器人)和开放模型的偏好。行业DeepSeekFireworks AI智能体推荐理由:Fireworks AI说开源模型需求火,AI客服机器人特别火,看看趋势榜都有谁。原文稍后读已读值得跟进有用关注 DeepSeek
09:41官方一手arXiv: DeepSeek@Wei Liu, Weisong Sun, Tingting Xu, Hanwei Qian, Yi Zhao, Chunrong Fang, Xia Feng本研究针对方法名预测(MNP)任务,发现现有评估多依赖token相似度指标(如BLEU)与人类判断不一致,且LLM直接代码-名称映射不及人类先理解再命名的过程。实验对比6种指标评估器、5种LLM评估器(包括DeepSeek)和6名人类评估者,显示DeepSeek评估器与人类判断更一致。进一步比较直接生成与摘要-精炼策略,后者提升了语义质量。基于此提出SMNP方法,融合MNP导向摘要和链式精炼,在5个LLM和2个数据集上验证了有效性。论文SMNPLLMMethod Name Prediction推荐理由:这篇论文告诉你:给代码自动取名时,先写摘要再命名比直接硬猜更靠谱。他们用DeepSeek做评估,效果比传统指标好十倍。原文稍后读已读值得跟进有用关注 SMNP
00:46官方账号Decoder@Jonathan Kemper72°中国AI实验室DeepSeek在刚关闭首轮70亿美元融资后仅几周又开始新一轮筹资。新资金将用于建设自有数据中心和芯片,以维持其激进的低价策略。此前DeepSeek通过大幅折扣API定价吸引用户,但高昂的算力成本迫使公司持续寻求外部资本。这反映出中国AI初创公司在扩张与盈利之间的资金压力。行业DeepSeek融资数据中心推荐理由:DeepSeek刚拿70亿美元又要钱,为了建自己的数据中心和芯片,维持低价策略,这说明烧钱战远没结束。原文稍后读已读值得跟进有用关注 DeepSeek
00:32AI Breakfast@AiBreakfastBloome 是一款跨平台 AI workspace 产品,支持人类与多个智能体在同一对话中协作:一个智能体起草、一个挑刺、一个润色终稿。它整合了 Claude、ChatGPT、DeepSeek 等不同模型,用户无需在标签页间切换。对话保持完整上下文,新加入的队友也能理解进展。Web、桌面和移动端均可使用,但桌面 app 体验更贴近真实团队协作。AI产品BloomeClaudeChatGPT推荐理由:如果你受够了在不同AI间切来切去,Bloome 让你把 Claude、ChatGPT、DeepSeek 都拉进一个对话,还能让智能体互相挑错改稿,桌面版用着真像团队开会。原文稍后读已读值得跟进有用关注 Bloome
00:09IT之家(博客/媒体)据彭博社报道,中国 AI 公司 DeepSeek 已开始筹备 IPO,计划在中国内地上市,最早于 2027 年完成。DeepSeek 正与会计师事务所和投行合作,目标在 2025 年底前完成财务报告。公司计划在 IPO 前进行新一轮私募融资,目标投前估值至少 4800 亿元人民币,拟融资至少 100 亿元。具体时间表可能根据市场环境和财报进度调整。行业DeepSeekIPO融资推荐理由:DeepSeek 要上市了!估值 4800 亿,融资至少 100 亿,AI 圈又一个大动作,想了解国内 AI 公司资本动向的可以看看。原文稍后读已读值得跟进有用关注 DeepSeek