11:14IT之家(博客/媒体)精选74°小红书于8月14日发布dots3-note preview开源大模型,总参数量280B、激活参数16B。华为昇腾Atlas 800 A3与Atlas 900 A3 SuperPoD已完成该模型全量适配,并基于vLLM Ascend推理引擎提供部署能力。昇腾在发布当天完成0 Day适配,通过FlashComm通信优化与FUSED_MC2通算融合提升MoE推理吞吐。MTP投机解码原生支持降低了单Token生成耗时TPOT。该模型具备文本、视觉、语音全模态感知能力。AI模型dots3-note preview昇腾小红书1 个信源在谈事件专题推荐理由:小红书开源了dots3-note preview,华为当天就完成昇腾适配,280B参数全模态模型现在就能在Atlas上跑。原文稍后读已读值得跟进有用关注 dots3-note preview
16:38IT之家(博客/媒体)华为于8月7日在深圳坂田基地启动AIPL基线合作伙伴计划,联合12家教育科技伙伴共建AI实践教学方案。该计划采用“1+X+N”伙伴体系,以昇腾算力与AIPL使能平台为底座,整合行业AI实践案例,推动“真场景、真数据、真算法”进校园。华为高教军团总裁杜敏称此举是产教融合从“示范标杆”迈向“规模复制”的关键一步。相关生态成果将亮相9月华为全联接大会2026全球发布会。行业华为AIPL昇腾推荐理由:华为拉上12家教育伙伴搞AI实践教学,用昇腾算力打底,目标是让高校快速落地AI课程,9月全联接大会还有新东西,教育圈可以关注。原文稍后读已读值得跟进有用关注 华为
00:20向阳乔木@vista8DeepSeek V4 Pro综合性能进入全球第一梯队。其编程能力与Claude旗舰差距仅0.3%。API定价是海外竞品的1/10到1/100。模型原生适配华沟昇腾95OPR,补齐国产算力闭环。AI模型DeepSeekV4 ProClaude1 个信源在谈事件专题推荐理由:DeepSeek V4 Pro编程只比Claude旗舰差0.3%,API价格便宜很多,还适配国产芯片,性价比拉满。原文稍后读已读值得跟进有用关注 DeepSeek
20:39IT之家(博客/媒体)蚂蚁百灵开源了原生混合推理模型 Ling-3.0-flash。华为同步完成昇腾 0 Day 适配,兼容 A2、A3 系列产品,分别需要 8 卡和 4 卡。适配过程首次引入 CANN PyPTO 算子编程框架,基于 PTO ISA 的 Tile 编程范式实现自动化。CANNBot PyPTO Agent 将算子开发拆成 7 个阶段,全程无需人工介入。AI产品Ling-3.0-flash昇腾CANN PyPTO推荐理由:华为把昇腾适配到蚂蚁百灵 Ling-3.0-flash 了,还推出 CANN PyPTO 框架,写算子的活能自动跑完。原文稍后读已读值得跟进有用关注 Ling-3.0-flash
17:28IT之家(博客/媒体)72°华为计算8月5日宣布,昇腾基于Ascend C编程语言提供完整训推一致算子集。在Qwen3-30B MoE模型上测试实现Logdiff为0,并通过FA算子优化在Eager模式下获得20%-60%性能收益。该方案通过统一注意力语义、锁定reduce累加序等4项修改,解决训练与推理累加不保序问题。相关基础设施已开源至GitHub,并将上线训推一致问题识别Skill。AI模型昇腾Ascend CQwen3-30B1 个信源在谈事件专题推荐理由:华为昇腾把RL训推一致做出来了,Qwen3-30B上Logdiff归零,还能提速20%-60%,搞强化学习训练可以看看。原文稍后读已读值得跟进有用关注 昇腾
10:38官方一手Pandaily@contact@pandaily.com (Pandaily)82°华为开源openPangu-2.0-Pro,发布模型权重、推理代码和技术报告。该模型拥有5050亿参数,推理时稀疏激活1800亿参数,上下文窗口达到512K。华为称它是首个完全在昇腾NPU上训练的前沿模型,也是首个完全不依赖NVIDIA硬件的500B以上开源模型。余承东此前曾表示要让盘古成为世界第一。AI模型openPangu-2.0-Pro华为盘古10 个信源在谈事件专题推荐理由:华为把500B级大模型开源了,权重代码报告都给了,还是在昇腾上训的,不用N卡也能跑。原文稍后读已读值得跟进有用关注 openPangu-2.0-Pro
10:00IT之家(博客/媒体)74°华为半导体首席科学家廖恒在7月25日近5小时专访中首次提出半导体产业链“18层宝塔”理论,认为产业上限由最短短板层级决定。他评价DeepSeek创始人梁文锋在行业盲从Scaling Law时选择了稀疏激活架构,称之为“先验者”。廖恒坦言自己在华为曾误判鲲鹏ARM服务器CPU、昇腾训练卡和数据中心算力需求三个方向。他认为摩尔定律在7nm制程后经济性停滞,国产芯片突围需全产业链协同。行业华为昇腾DeepSeek2 个信源在谈事件专题推荐理由:华为芯片老将廖恒开口了,讲18层宝塔理论,还夸DeepSeek梁文锋,自曝三次误判,全程干货。原文稍后读已读值得跟进有用关注 华为
11:12shao__meng@shao__meng华为在 Hugging Face 发布 openPangu-2.0-Pro 的开源权重。官方称这是首个完全在昇腾 NPU 上训练的 500B+ 级模型,MoE 总参数量 505B、激活 18B,上下文 512K。在少量有交集的基准上,GPQA-Diamond 87.9,低于 Kimi K3 的 93.5 和 GLM-5.2 的 91.2;SWE-bench Verified 68.5,与 DeepSeek V3.1 的 66.0 接近。其 BrowseComp 65.7 也明显落后于 Kimi K3 的 91.2。AI模型openPangu-2.0-Pro华为昇腾8 个信源在谈事件专题推荐理由:华为开源 openPangu-2.0-Pro(505B/512K,昇腾训练),但 GPQA 87.9 不如 Kimi K3。原文稍后读已读值得跟进有用关注 openPangu-2.0-Pro
16:21IT之家(博客/媒体)75°月之暗面于7月27日正式开源Kimi K3,总参数量达2.8万亿,是全球首个开源3万亿级别模型,面向长程编程、知识工作和推理场景。华为宣布昇腾实现0day极速适配:训练侧基于MindSpeed MM在Atlas 800 A3、Atlas 900 A3 SuperPoD上完成减层训练适配,并进行算子、并行加速、显存优化;推理侧通过vLLM Ascend和SGLang快速部署,昇腾950超节点支持FP8、MXFP8、MXFP4等全系列精度,原生支持Kimi K3的mxFP4量化权重。此外,月之暗面同步开源了支撑Kimi K3训练的MoonEP、FlashKDA和AgentEnv三项Infra技术。AI模型Kimi K3昇腾月之暗面10 个信源在谈事件专题推荐理由:华为昇腾第一时间适配了刚开源的Kimi K3,2.8万亿参数模型能在昇腾上跑训练和推理了,还支持mxFP4量化。原文稍后读已读值得跟进有用关注 Kimi K3
23:48量子位@思邈该模型在由李飞飞团队构建的视觉语言基准中拿下第一。它完全适配华为昇腾算力平台,无需依赖英伟达硬件。代码和全部权重已开放,社区可直接下载使用。从一张静态图就能生成连贯视频,展现物理规律。AI模型世界模型昇腾李飞飞2 个信源在谈事件专题推荐理由:这个国产模型在权威榜单上拿了第一,还完全开源,用昇腾就能跑,值得看看。原文稍后读已读值得跟进有用关注 世界模型
17:30IT之家(博客/媒体)72°华为在互联网行业媒体沟通会上指出,AI大模型进入规模化商用阶段,过去半年Token消耗量增长6倍,模型调用次数增加50至100倍。运力成为算力、存力、运力三者中最突出的瓶颈。华为将NPO带宽提升八倍以上,Token产生效率提升五倍,并推出星河AI数据中心网络和昇腾超节点实现网算存协同。预计2027-2030年Token经济将全面影响所有作业行为。行业华为昇腾算力1 个信源在谈事件专题推荐理由:华为说别只盯着芯片制程了,运力才是瓶颈。Token用量半年涨6倍,他们用网算存协同把带宽提了8倍,效率升5倍,想降成本可以看看。原文稍后读已读值得跟进有用关注 华为
09:32IT之家(博客/媒体)7月9日,粤港澳大湾区国产智算超万卡集群在韶关上线。该集群总投资55亿元,部署11520张昇腾国产AI加速算力芯片,总算力达9000P。建设耗时仅90天,全面打通电力、液冷、算力等环节,服务于国产大模型研发与中小企业数字化。行业昇腾粤港澳大湾区韶关推荐理由:55亿、11520张昇腾芯片、9000P总算力,这个国产集群全自主可控,90天建成,算力自主的新标杆。原文稍后读已读值得跟进有用关注 昇腾
23:29IT之家(博客/媒体)2026年6月29日,华为与陕文投联合开发的“博观文旅大模型”在西安实现规模化应用,这是全球首个商用的多模态文旅大模型。该模型依托1.2PB文旅数据集,包含3100万张图片、440万分钟文博影像等。其支撑开发的AI伴游智能体已覆盖超400万用户,非遗数字IP衍生产品销售额超200万元。此外,“博观”还基于昇腾算力底座,成为首个以文化保护和传承为核心的行业大模型。AI模型博观文旅大模型华为陕文投1 个信源在谈事件专题推荐理由:华为和陕文投把多模态大模型用在了文旅行业,能生成博物馆级文物内容,还能做非遗IP,已服务400万用户,值得看看。原文稍后读已读值得跟进有用关注 博观文旅大模型
14:28量子位@梦晨华为云发布Agent基础设施,提供分布式算力调度和存储方案,支持百万级Agent协同工作。新架构基于自研昇腾芯片,推理延迟降低40%。同时推出Agent开发平台,集成模型部署和调试功能。该基础设施已用于金融、制造等行业场景。行业华为云Agent昇腾1 个信源在谈事件专题推荐理由:华为云给Agent铺路了原文稍后读已读值得跟进有用关注 华为云
09:47IT之家(博客/媒体)精选华为云与MiniMax达成深化合作,基于昇腾算力底座为M3模型提供Tokens算力支持。M3采用MSA注意力架构,支持1M超长上下文,是原生多模态模型,可处理图片、视频输入并操作电脑桌面。在SWE-Bench Pro上,M3超过GPT-5.5和Gemini 3.1 Pro,接近Opus 4.7;在SVG-Bench上超过Opus 4.7;在OmniDocBench上超过Gemini 3.1 Pro;在Claw-Eval上获得最高分。华为云通过昇腾算力优化MSA算子和MOE均衡,保障M3大规模推理性能。AI模型MiniMaxM3华为云1 个信源在谈事件专题推荐理由:华为云联手MiniMax,M3多模态模型开源原文稍后读已读值得跟进有用关注 MiniMax
15:07IT之家(博客/媒体)73°华为在 HDC 2026 上正式发布开源盘古 openPangu 2.0 模型,包含 Pro(505B 总参数/18B 激活)和 Flash(92B 总参数/6B 激活)两个版本,支持 512K 上下文。该模型针对昇腾算力优化,单卡吞吐率是业界主流开源模型的 2 倍,并适配鸿蒙系统,在 Agent 任务上更快更准更省。华为计划从 6 月 30 日起陆续开源 7 大组件,包括预训练代码、后训练代码和训练算子。余承东坦言,由于算力大量支持国内其他企业,华为自留算力有限,因此模型参数规模控制在 505B,更聚焦时延和吞吐率提升。AI模型华为盘古 2.0开源模型推荐理由:华为开源盘古 2.0 解决了国产大模型在昇腾生态下的部署效率问题,使用昇腾算力的开发者和企业可以直接受益,建议关注 6 月 30 日的开源组件发布。原文稍后读已读值得跟进有用关注 华为
22:06IT之家(博客/媒体)欧洲电信标准化协会(ETSI)正式发布了由华为牵头制定的技术规范 ETSI TS 104 033,这是 ETSI 首个面向 AI 计算平台安全要求的国际标准。该标准于 2023 年 11 月由华为在 ETSI SAI 会议上牵头立项,获得了英国电信、高通、博世等国际伙伴支持。标准针对 AI 计算平台面临的安全风险提出了缓解措施要求,华为昇腾安全解决方案已系统化落实这些要求,覆盖从数据中心超节点到边缘推理设备。该标准现已开放下载。行业AI 安全国际标准华为推荐理由:AI 计算平台的安全标准终于有了国际规范,做 AI 基础设施和云服务的团队值得关注——华为昇腾方案已落地,这意味着合规和安全设计有了明确参考。原文稍后读已读值得跟进有用关注 AI 安全