早读VOL 2026.09.19308 篇
智谱GLM-5.3-FlashX推理速度达200 tokens/s,AI代理与多模态技术持续突破
新加坡·二〇二六年九月十九日 星期六·DAILY · 每早八时
2026年9月19日,AI领域迎来多项重要进展。智谱AI推出的GLM-5.3-FlashX模型,在约10万颗国产加速器上实现每秒200个token的推理速度,基于320亿参数的混合专家(MoE)架构。研究方面,新方法让AI代理更高效探索环境,在代码编辑任务上提升性能;新框架FedQoS在智能汽车中通过资源感知训练门控和QoS感知传输策略,减少76.7%通信开销和26.0%延迟成本。此外,FAMOS模型实现从稀疏观测中预测3D物体关节参数,新框架提升表格结构解析能力,Deep Noir框架可自动发现LLM推理时的最优引导参数。
01
模型发布/更新
3 篇02
产品发布/更新
3 篇华为发布全球首个采用 NPO 的超节点“昇腾 960 超节点”,2027 年 Q3 上市
华为发布了全球首个采用 NPO 技术的超节点,能大幅提升大模型训练和推理的效率,和传统方案相比,功耗降低超 550 千瓦。
IT之家原文
Claude Code Projects 改版:引入 Thread 功能和 Tag 架构
Anthropic 给 Claude Code 加了个很酷的新功能,叫 Projects,把一个对话拆成多个线程并行干活,就像给幕僚长交代工作一样,几件事一起说就行,不用自己开多个终端了。
03
行业动态
3 篇04
论文研究
3 篇05
技巧与观点
3 篇亚马逊 SageMaker AI 支持部署 Hugging Face 模型
亚马逊 SageMaker AI 现在支持部署 Hugging Face 模型了,指向模型就能自动创建实时端点,包含服务容器、自动扩展和 CloudWatch 警报。
开源「设计工程」概念集,把界面「完成感」细节提炼成可执行规则
朋友分享的「设计工程」概念集,把界面「完成感」细节(等宽数字、光学对齐)提炼成可执行规则,对写 UI 的 coding agents 很有用。
308今日事件
145一手报道
93新模型
79信源
AITOP · 编辑系统自动生成