20:51IT之家(博客/媒体)精选OpenCV 团队正式发布 OpenCV 5,这是该计算机视觉库的重大现代化升级。新版本引入了基于图的 DNN 引擎,支持算子融合、广泛的 ONNX 算子(覆盖率从 23% 提升至 80%),并原生支持 Transformer、VLM 和 LLM 等大模型。此外,OpenCV 5 改进了 Python 集成、硬件加速层、3D 视觉功能,并弃用了传统 C API,使代码更紧凑。该库在 GitHub 拥有超 86,000 星,日安装量超百万次,此次更新旨在巩固其作为计算机视觉基础库的地位。AI产品OpenCV计算机视觉DNN引擎1 个信源在谈事件专题推荐理由:做计算机视觉、机器人或 AI 应用开发的团队,OpenCV 5 的 DNN 引擎和 ONNX 支持能直接提升模型部署效率,值得立即升级体验。原文稍后读已读值得跟进有用关注 OpenCV
17:48IT之家(博客/媒体)LG 集团计划引进 1 万块英伟达 Blackwell 架构 GPU,用于其人工智能转型计划,这是该集团有史以来最大规模的单次 GPU 采购。整体投资预计达数万亿韩元,涉及 LG 人工智能研究院、LG 电子和 LG U+ 等多个实体。此举旨在支持 EXAONE 大语言模型开发、人形机器人商业化及 AI 云服务。英伟达 CEO 黄仁勋今日会见了 LG 集团会长具光谟,暗示双方合作深化。行业英伟达Blackwell GPULG推荐理由:LG 大手笔采购 Blackwell GPU 表明 AI 基础设施投入进入新阶段,做模型训练或云服务的团队值得关注这一信号——算力军备竞赛正在加速。原文稍后读已读值得跟进有用关注 英伟达
15:49官方一手pandaily@contact@pandaily.com (Pandaily)DeepSeek 正在进行一轮约 500 亿人民币(约 69 亿美元)的融资,估值在 3500 亿至 4000 亿人民币之间(约 480-550 亿美元)。这标志着这家以成本高效大模型闻名的中国 AI 实验室首次大规模引入外部资本,此前它一直是最后一家没有外部融资的主要 AI 公司。该轮融资是 AI 历史上最大的私募融资之一,表明 DeepSeek 正从纯研究导向转向商业化,并开始探索消费者端变现。此举也反映了中国 AI 赛道资本竞争的加剧,以及投资者对高效模型商业前景的认可。行业DeepSeek融资大模型推荐理由:DeepSeek 从「不融资」到「天价融资」的转变,意味着中国 AI 竞争进入新阶段——做模型的人要关注资本如何重塑技术路线,投资者则要评估 500 亿美元估值是否合理。建议点开看融资细节和商业化信号。原文稍后读已读值得跟进有用关注 DeepSeek
13:48IT之家(博客/媒体)6 月 16 日,中国信通院等将在北京召开“高质量 Token 服务研讨会”,首次发布公有云大模型 Token 服务性能测评结果。论坛将成立“高质量 Token 服务特别研究组”,启动“能力攀登计划”,并上线新版性能监测平台。测评将客观量化主流 Token 服务的吞吐率、时延等指标,为产业选型提供参考。同时将发布系列标准,为通过评估的单位颁发证书。截至 2026 年 3 月,我国日均 Token 调用量已达 140 万亿次以上,较 2024 年初增长千倍。行业Token 服务性能测评中国信通院推荐理由:Token 服务性能测评首次公开,做模型选型或部署的团队可以直接参考权威数据,避免踩坑。原文稍后读已读值得跟进有用关注 Token 服务
20:04官方一手pandaily@contact@pandaily.com (Pandaily)智谱AI在5月28日股价盘中一度达到7000亿港元(约900亿美元)市值,但随后大幅回调。该公司2024年营收仅7亿元人民币(约9600万美元),对应估值高达750倍营收,引发市场对其生存压力的关注。智谱AI被视为中国版的Anthropic,专注于大模型研发,但高估值与低营收的对比凸显了AI初创公司面临的商业化挑战。此次IPO计划于2026年6月进行,市场对其能否持续增长存疑。行业智谱AI估值IPO10 个信源在谈事件专题推荐理由:智谱AI的高估值与低营收对比揭示了AI泡沫风险,关注AI投资和创业的读者值得一读,了解中国大模型公司的生存现状。原文稍后读已读值得跟进有用关注 智谱AI
11:54向阳乔木@vista8精选72°斯坦福大学研究团队发现,当模型规模足够大时,使用未过滤的Common Crawl数据训练效果反而优于经过清洗的数据。在15M小模型上,过滤数据全面领先;但在330M和1B模型上,未过滤数据在充分训练后超越了所有过滤版本。这表明大模型有足够参数空间将噪声与有用信息分离,颠覆了数据清洗越干净越好的传统认知。论文大模型数据清洗Common Crawl推荐理由:这项研究挑战了数据清洗的行业惯例,做大模型训练的团队值得关注——或许可以省下大量清洗成本,直接喂原始数据。原文稍后读已读值得跟进有用关注 大模型
10:30官方一手arXiv: DeepSeek@Baijun Ji, Zixuan Zhou, Xiangyu Duan, Yu Liu, Longbo Sun, Rupu Wei, Bohong Zhao文档级机器翻译需要捕捉长距离的篇章依赖关系,现有方法缺乏对结构化篇章依赖的显式建模。本文提出 G^2C-MT,将上下文选择视为轻量级篇章图上的结构化路径发现问题,通过将段落表示为节点并建模语义相似度、邻接和关键词重叠关系,再使用深度偏置随机游走采样上下文路径,引导大模型翻译。该方法支持多路径采样,能聚合多样候选翻译以提升鲁棒性。实验表明,G^2C-MT 在 DeepSeek-V3、Gemini-2.5-Flash-lite 和 Qwen-2.5/3 系列等多个大模型上均优于强基线。论文文档级翻译图引导上下文篇章建模推荐理由:做文档翻译或长文本处理的团队终于有了不依赖昂贵 LLM 的上下文建模方案——G^2C-MT 用图结构替代暴力检索,翻译质量提升且成本可控,做 NLP 应用的建议点开看看方法细节。原文稍后读已读值得跟进有用关注 文档级翻译
07:05IT之家(博客/媒体)美国总统特朗普于6月3日签署行政令,推出AI企业自愿合作机制:前沿大模型在正式发布前,企业可自愿向联邦政府提交模型进行安全评估。该行政令旨在平衡技术创新与安全风险,避免繁重监管的同时,强化关键基础设施网络安全防护。新规将前置报备窗口期缩短至发布前30天,企业配合提交可享受保密保护。此举标志着特朗普政府从宽松放任转向适度监管,起因于Anthropic的Mythos模型自主排查出数千项高危系统漏洞。谷歌、微软与xAI已同意参与,行业机构也给予正面评价。行业AI安全政策监管特朗普10 个信源在谈事件专题推荐理由:特朗普政府从「放任」转向「自愿安全评估」,做AI大模型的企业需要关注这个信号——提交模型可获保密保护,不提交也无强制压力,但安全漏洞风险正在倒逼监管。建议AI安全负责人和合规团队点开了解窗口期和参与机制。原文稍后读已读值得跟进有用关注 AI安全
12:06官方一手arXiv: DeepSeek@Boao Kong, Weichen Jia, Engao Zhang, Guohong Li, Yonghan Dong, Yao Wang, Yaoyuan Wang, Yunke Peng, Kun Yuan低精度训练在降低大模型训练成本的同时,常因少数算子的数值不稳定导致训练失败。论文提出GNMR(梯度范数与均值比)轻量控制器,通过比较当前梯度范数与历史均值,并结合Δ-GNMR检测短窗口内的突变,在固定预算和锁定间隔内执行恢复操作,无需改变数值格式或底层实现。在激活量化、DeepSeek式训练和LLaMA-2 13B微调等场景中,GNMR以稀疏的恢复动作保持高保真质量。该方法为低精度训练提供了一种后端无关的稳定性控制方案。论文低精度训练训练稳定性GNMR推荐理由:低精度训练是降低大模型成本的关键,但数值不稳定常让训练白费。GNMR用轻量控制解决了这个痛点,做大规模训练或量化训练的团队值得关注,可以直接集成到现有流程中。原文稍后读已读值得跟进有用关注 低精度训练
11:08官方账号arXiv cs.AI@Xiang Li, Jiwei Wei, Ke Liu, Yitong Qin, Jinyu Guo, Malu Zhang, Peng Wang, Yang YangeMoT 提出了一种名为“演化思维记忆”的新框架,将推理轨迹视为动态演化的记忆而非静态模板,以解决大模型在多步推理中的幻觉和数值计算问题。该框架包含三个核心模块:记忆腐蚀机制(强化高效用推理结构并衰减低频结构)、符号锚定引擎(利用 Python 进行确定性计算,类似人类使用计算器)以及一致性驱动精炼过程(对齐神经推理与符号结果,减少逻辑偏差)。在 Game of 24 任务上,eMoT 达到 100% 准确率,比基线提升 17.6%;在 GSM8K、ASDiv、SVAMP 和 MGSM 等数学推理基准上也有持续改进。即使使用轻量级模型,eMoT 也优于依赖大规模模型的方法,表明性能提升主要来自框架的推理控制而非模型规模。论文推理模型记忆机制符号锚定推荐理由:eMoT 解决了大模型在多步推理中容易出错和产生幻觉的痛点,做推理增强或数学推理的开发者可以直接参考其记忆腐蚀和符号锚定机制,值得一试。原文稍后读已读值得跟进有用关注 推理模型
13:06Gary Marcus@GaryMarcusGary Marcus在X上转发了他与Ernest Davis于2021年合著的文章观点,强调大规模预训练模型虽在近期AI和商业应用中占据重要地位,但仅靠这些技术不足以实现通用人工智能。他认为,当前研究策略聚焦于可解决的短期挑战,却忽视了更关键的需求:为可靠整合统计学习与推理、知识、常识及人类价值观奠定坚实基础。Marcus的言论再次引发对AI发展路径的讨论,提醒业界不要过度依赖大模型。行业大模型通用AIGary Marcus推荐理由:Marcus的观点戳中了当前AI热潮中的核心争议,关注AI长期发展的研究者、从业者或投资者值得一读,看完会对大模型的局限性有更清醒的认识。原文稍后读已读值得跟进有用关注 大模型
12:00官方账号Google AI@GoogleAIGoogle AI发布了一期《Release Notes》播客,邀请了Gemini模型的核心架构师Jeff Dean、Koray Kavukcuoglu、Oriol Vinyals和Noam Shazeer共同出镜。他们分享了从愿景到模型落地的幕后故事,探讨了如何持续推动AI前沿。这期节目为关注大模型研发的从业者提供了难得的第一手视角。AI模型GeminiGoogle AI大模型推荐理由:Gemini核心团队首次集体出镜聊幕后,做大模型研发的从业者能从他们的思考中看到前沿方向,值得花时间听一听。原文稍后读已读值得跟进有用关注 Gemini
13:38岚叔@lufzzliz精选本文揭示大模型在生成低频词汇(如冷门人名)时表现不佳,并非小bug,而是底层偏好高频表达所致。作者串联了“马嘉祺”事件、Anthropic tokenizer调整以及FaceMind团队的SLoW和Adam's Law研究,指出频率是大模型数据工程的关键变量。FaceMind早于大众关注低频token退化问题,将其写成论文并落地产品场景。文章还解释了为何prompt并非越多越好,以及高频同义表达更稳定。最后介绍了FaceMind的动态弹幕产品,暗示其可能应用于世界杯等场景。AI模型大模型低频tokenFaceMind10 个信源在谈事件专题推荐理由:做AI应用或数据工程的团队,这篇把低频token退化讲透了——FaceMind的SLoW方法直接给出了解决方案,值得点开看看怎么从模型规律里建立产品差异。原文稍后读已读值得跟进有用关注 大模型
19:56IT之家(博客/媒体)科大讯飞在澳门 BEYOND Expo 2026 上推出 AI 眼镜,定位为“眼前的超级 AI 助理”,售价 4299 元,6 月 15 日开启预售。眼镜仅重 40 克,采用经典眼镜形态,通过 SGS 舒适度认证。核心功能是搭载端到端语音同传大模型,支持 122 种语言翻译,覆盖通话、线上同传、同声传译、面对面翻译、视觉翻译等六大场景。此外,还支持实时提词、AI 助理(GlassClaw)和会议纪要自动生成。产品将大模型能力融入日常佩戴,旨在解决跨语言沟通和演讲痛点。AI产品AI 眼镜科大讯飞语音翻译推荐理由:科大讯飞把大模型塞进 40 克眼镜里,解决了出国旅行、商务会议中语言不通的痛点,经常出差或做国际业务的用户可以直接关注。原文稍后读已读值得跟进有用关注 AI 眼镜
11:12官方一手歸藏(guizang.ai)@op7418MiniMax 宣布即将发布新一代 M3 模型,并开源其 MSA 架构。这是 MiniMax 沉寂一段时间后的重要更新,M3 模型预计在性能上有显著提升。开源 MSA 架构将推动社区研究和应用发展。该消息在推特上引发关注,但具体细节尚未公布。AI模型MiniMaxM3模型MSA架构推荐理由:MiniMax 的 M3 模型和开源 MSA 架构值得关注,尤其是对开源大模型和架构研究感兴趣的开发者,可以提前了解并准备试用。原文稍后读已读值得跟进有用关注 MiniMax
16:14IT之家(博客/媒体)抖音在谣言治理中引入大模型技术,过去一年谣言被处置时的平均浏览量下降62%。平台推出“AI求真”功能,通过求真卡为用户提供真实信息,建立认知防线。抖音还盘点了十大辟谣案例,均由AI求真大模型识别或处置。该功能于去年9月上线,用户浏览易误解内容或搜索谣言时,可通过大模型获取完整信息。AI产品大模型谣言治理AI求真推荐理由:抖音用大模型把谣言处理效率提升了,做内容审核或平台运营的团队可以看看这套方案的实际效果,值得参考。原文稍后读已读值得跟进有用关注 大模型
13:26爱范儿@Selina中国 AI 公司成功将 600 亿参数的大模型部署到手机上,突破了模型体积与移动端算力的瓶颈。这一进展依赖于国产框架、芯片和模型的闭环生态,实现了从方法论到硬件的完全自主。该技术让手机端运行超大模型成为可能,显著提升本地 AI 能力,减少对云端的依赖。关键细节包括模型压缩和推理优化技术,使得在有限内存和功耗下高效运行。这对移动 AI 应用和国产技术生态具有重要意义。AI产品大模型手机部署国产技术推荐理由:手机端跑 600 亿参数模型不再是梦,做移动端 AI 应用或关注国产技术生态的开发者,值得关注这一突破,它可能改变未来手机 AI 的玩法。原文稍后读已读值得跟进有用关注 大模型
12:24Yangyi@Yangyixxxx从今年年初开始,由于大模型蒸馏技术的过度使用,AI模型出现了自言自语的现象。蒸馏是指用大型模型训练小型模型的过程,但频繁的蒸馏可能导致模型学习到一些无意义的内部对话模式。这种现象可能影响模型的输出质量和可靠性,引发对AI训练方法的反思。目前该问题已引起研究者的关注,需要进一步探索蒸馏的合理边界。AI模型大模型蒸馏模型行为推荐理由:做模型蒸馏或训练AI的团队值得关注——过度蒸馏可能导致模型行为异常,影响实际部署效果,建议点开了解具体表现和潜在风险。原文稍后读已读值得跟进有用关注 大模型
21:16官方账号Decoder@Matthias Bastian70°DeepMind联合创始人Demis Hassabis认为人类已站在技术奇点的山脚,而Meta首席AI科学家Yann LeCun表示当前AI系统并非真正智能。Gemini联合负责人Oriol Vinyals则持中间立场,称七年前今天的模型会被视为AGI,但它们仍无法从经验中学习或产生真正突破。三位AI领域顶级专家在观点上存在显著分歧。行业大模型AI安全DeepMind推荐理由:三位AI大佬对奇点和智能看法不一原文稍后读已读值得跟进有用关注 大模型
21:10Gary Marcus@GaryMarcusGary Marcus 在 X 上发帖,将 LLM 公司与航空公司类比,指出两者都面临小利润、激烈竞争和高开支。他引用 Ross Atefi 的观点,强调无限需求并不保证经济吸引力。Marcus 认为 AI 行业的关键问题不是人们是否想要更多智能,而是提供商在芯片、数据中心、电力、冷却和竞争后能否保留足够现金。行业大模型行业分析Gary Marcus推荐理由:Marcus 用航空公司比喻 LLM 行业原文稍后读已读值得跟进有用关注 大模型
19:22IT之家(博客/媒体)一项提交至《天体物理学杂志》的研究指出,银河系中数量最多的亚海王星和超级地球内部构造可能不同于地球。当行星捕获的氢质量占比超过1%时,内部铁、硅酸盐与氢在4000开尔文以上高温下会融合成单一流体,而非形成独立金属内核。该理论可解释半径空隙现象,即超级地球与亚海王星之间行星数量稀少,以及行星半径与公转周期的关联。詹姆斯·韦伯太空望远镜和开普勒太空望远镜的观测数据支持这一模型,但模型基于极端环境下的性质推演,存在局限性。论文大模型天体物理学系外行星推荐理由:颠覆你对行星构造的认知原文稍后读已读值得跟进有用关注 大模型
19:05rohanpaul_ai@rohanpaul_ai精选70°华为推出122.88TB AI SSD,采用Die-on-Board封装技术,将NAND芯片直接焊在电路板上,而非依赖三星400+层3D NAND。该方案通过提高板级密度实现高容量,但面临散热和信号问题。未来计划推出245TB版本。此举表明出口管制迫使创新转向封装而非芯片本身。行业大模型存储华为推荐理由:华为用封装技术绕过芯片限制原文稍后读已读值得跟进有用关注 大模型
19:04rohanpaul_ai@rohanpaul_ai70°《经济学人》报道,五大科技巨头今年将在AI基础设施上投入约8000亿美元,但利润表几乎未体现这些投资,因为折旧在资产建成后才开始。现金流表则直接显示资金已流出。这些公司的资本支出可能占其收入的40%,超过石油行业的页岩繁荣期和电信行业的互联网泡沫时期。行业大模型AI基础设施资本支出推荐理由:看看AI烧钱有多猛原文稍后读已读值得跟进有用关注 大模型
18:22官方账号Decoder@Matthias Bastian数学家Adam Kucharski发现,当向Microsoft Copilot输入相同数据集但不同国家标签时,Copilot会编造不存在的国家差异,输出详细刻板印象而非准确结果。思考模型能识别这种把戏,但前提是用户知道何时使用它们。文章指出,在Copilot、Gemini等AI工具中保留默认模型选择可能导致错误结论,用户应主动选择适合任务的模型。技巧大模型AI安全Copilot推荐理由:别让AI默认模型坑了你原文稍后读已读值得跟进有用关注 大模型
18:07IT之家(博客/媒体)长安第四代逸动蓝鲸超擎车型上市,共三款车,抢购价7.99-8.99万元。新车长宽高4785/1840/1460mm,轴距2765mm,内饰配备10.25英寸仪表和14.6英寸中控屏。全系标配内置DeepSeek的AI大模型语音系统,搭载天枢智慧座舱和天枢OS车机系统。配置方面,悦享型新增256色氛围灯、ACC自适应巡航等,智享型增加50W无线快充、全景天窗等。AI产品大模型DeepSeek智能座舱推荐理由:长安新车7.99万起,语音接入DeepSeek原文稍后读已读值得跟进有用关注 大模型
17:01官方一手marktechpost@Asif Razzaq精选70°微软研究院推出Webwright,一个终端原生的浏览器Agent框架,用可复用的Playwright脚本替代点击追踪式网页自动化。该框架仅用约1000行代码和三个模块的单Agent循环,在长程任务基准Odysseys上达到60.1%,远高于基础GPT-5.4的33.5%。在Online-Mind2Web上得分86.7%,是开源测试方案中AutoEval最高分。AI模型AgentMCP/工具开源/仓库推荐理由:微软开源了能跑60%的Web Agent框架原文稍后读已读值得跟进有用关注 Agent
16:55官方账号Decoder@Matthias BastianAnthropic可能继续向美国国家安全局(NSA)供应其Claude AI模型,尽管五角大楼将其标记为“供应链风险”。情报机构缺乏Nvidia最新的Grace Blackwell芯片,而Anthropic的“Mythos”模型据称可在旧硬件上运行。此前导致谈判破裂的“任何合法用途”条款未被纳入协议。行业AnthropicClaudeAI安全10 个信源在谈事件专题推荐理由:Anthropic与NSA的Claude交易有变原文稍后读已读值得跟进有用关注 Anthropic
16:43IT之家(博客/媒体)微软要求员工改用自研Copilot CLI而非Claude Code,因后者使用成本随用户增多而攀升。其他企业也在缩减AI工具使用规模,智能体词元消耗量可达普通大语言模型查询的上千倍。OpenClaw创始人称其团队单月词元使用成本超130万美元(约885.6万元人民币)。词元单价下降但使用量上涨,体现杰文斯悖论,AI开销已高于人力成本且效率提升有限。行业大模型AI成本智能体4 个信源在谈事件专题推荐理由:AI成本比人力还高,企业别盲目推原文稍后读已读值得跟进有用关注 大模型
16:37官方账号阿里云 Alibaba Cloud@alibaba_cloud5月26日,阿里云国际业务副总裁、北美区域总经理陈亮将在新加坡金沙会展中心主舞台演讲。主题为Agent Engine的规模化推理与智能体释放。该活动聚焦AI推理和Agent技术的大规模应用。行业智能体Agent大模型推荐理由:阿里云高管讲Agent规模化原文稍后读已读值得跟进有用关注 智能体
16:36官方账号阿里云 Alibaba Cloud@alibaba_cloud5月26日,Picsart视频产品主管Narek Hayrapetyan将在新加坡金沙会展中心分享多模态AI如何彻底改变视觉创作。活动由阿里云主办,聚焦AI在图像和视频生成中的实际应用。参与者可现场了解多模态模型如何提升创作效率。行业多模态视频生成大模型推荐理由:听Picsart高管讲多模态创作原文稍后读已读值得跟进有用关注 多模态
16:29rohanpaul_ai@rohanpaul_aiAI发展正从算法问题转向物理基础设施挑战,包括土地、电网、许可、混凝土和冷却等环节。Vantage Data Centers获得Oracle和OpenAI超过150亿美元联合投资,用于建设大规模数据中心。这些物理限制将决定谁能获得计算资源,影响AI行业竞争格局。行业大模型算力数据中心9 个信源在谈事件专题推荐理由:算力争夺战打到工地上了原文稍后读已读值得跟进有用关注 大模型
16:28rohanpaul_ai@rohanpaul_ai前谷歌高管Mo Gawdat在播客中提出,智能不是物理属性,因此无论由碳基(人类)、硅基(当前AI硬件)还是量子基(未来)结构产生,本质相同。他认为,当人类停止将自己的智能强加于机器时,机器才能产生真正的智能。该观点来自《The Diary Of A CEO》与Mo Gawdat的对话。论文智能体大模型Mo Gawdat推荐理由:重新思考AI的本质定义原文稍后读已读值得跟进有用关注 智能体
16:25官方账号Decoder@Jonathan Kemper精选75°来自马里兰大学、Google、Meta等机构的研究者使用AutoTTS框架,让Claude Code自主发现AI推理控制算法。该算法相比标准自一致性方法,在保持相同准确率的同时,计算量减少约70%。整个搜索过程仅花费40美元,耗时160分钟。论文智能体推理模型大模型推荐理由:AI自己设计算法,省钱又高效原文稍后读已读值得跟进有用关注 智能体
16:21berryxia@berryxia一条社交媒体帖子指出,传统杂志错误报道GPT-6已发布一个半月,实际OpenAI最新模型为GPT-4o。该杂志内容引发网友调侃,显示信息滞后。事件反映媒体在AI领域报道中可能存在的时效性问题。行业大模型GPTOpenAI9 个信源在谈事件专题推荐理由:杂志闹乌龙,GPT-6纯属虚构原文稍后读已读值得跟进有用关注 大模型
16:02官方账号阿里云 Alibaba Cloud@alibaba_cloud阿里巴巴通义大模型业务部多模态交互负责人Steven Hoi教授将于5月26日在新加坡金沙会展中心发表主题演讲,探讨Agent时代的基础模型。该演讲聚焦于基础模型如何支撑智能体应用的发展。活动面向AI从业者和研究者开放注册。行业Agent大模型多模态推荐理由:阿里专家讲Agent时代基础模型原文稍后读已读值得跟进有用关注 Agent
15:46IT之家(博客/媒体)精选中国科学院大连化学物理研究所与沈阳自动化研究所联合研制出智能透射电子显微镜“原眼一号”,实现“传样—成像—解析”全流程自主运行。该设备在催化剂分析中单日可处理200个样品,采集5000张图像,定量解析50万个颗粒。相比现有设备,图像获取速度提升约56倍,分析效率达人工的约300倍。两周数据量相当于传统电镜一年工作量。AI产品智能体大模型原眼一号推荐理由:国产电镜效率提升300倍原文稍后读已读值得跟进有用关注 智能体
15:43官方一手marktechpost@Asif Razzaq精选70°NVIDIA 发布 Gated DeltaNet-2,一种线性注意力层,将 Delta 规则中的擦除和写入操作解耦为通道级擦除门 b_t 和写入门 w_t。在 1.3B 参数、100B FineWeb-Edu 令牌训练下,它在语言建模、常识推理和长上下文检索任务上超越 Mamba-2、Gated DeltaNet、KDA 和 Mamba-3。最大提升出现在 RULER S-NIAH 和多键针检索基准上。AI模型大模型推理模型Mamba4 个信源在谈事件专题推荐理由:NVIDIA 新线性注意力,解耦擦写门原文稍后读已读值得跟进有用关注 大模型
15:34orange.ai@oran_geDeepSeek V4 Pro模型在性能上并非最佳,但其缓存技术几乎免费,可大幅降低推理成本。Opus模型应用该技术后成本下降10倍。V4.1版本将使用真实harness数据训练,有望快速提升性能。AI模型大模型DeepSeek缓存推荐理由:缓存技术让成本降10倍原文稍后读已读值得跟进有用关注 大模型
14:46IT之家(博客/媒体)第56届IEEE国际电路与系统研讨会(ISCAS 2026)于5月24日在上海国际会议中心开幕,会期至5月27日。会议主题为“面向智能社会的电路与系统”,涵盖人工智能、汽车智能系统、脑科学等前沿方向。华为董事何庭波和中国科大潘建伟院士将发表演讲,分享量子信息领域成果。本届ISCAS首次获得中国计算机学会(CCF)B类会议认定,选址上海凸显中国在该领域影响力。行业大模型AI安全智能体推荐理由:ISCAS 2026在上海,何庭波潘建伟都来了原文稍后读已读值得跟进有用关注 大模型
14:44rohanpaul_ai@rohanpaul_ai精选有人用单张RTX 3060 12GB GPU和768GB二手Intel Optane持久内存运行了1万亿参数的Kimi K2.5模型,速度超过4 tokens/sec。Kimi K2.5是混合专家模型,总参数1T但每token仅激活32B。RTX 3060的12GB VRAM处理路由、注意力等延迟敏感部分,专家权重存储在Optane PMem中,192GB DDR4 ECC作为缓存。Optane PMem延迟比最佳NVMe SSD低很多,但比DRAM慢2-3倍。llama.cpp通过override-tensor标志调整张量放置,实现混合GPU/CPU推理。AI模型Kimi K2.5混合专家模型推理模型推荐理由:用旧硬件跑万亿模型,省钱又酷原文稍后读已读值得跟进有用关注 Kimi K2.5