7月23日
14:31
14:31官方账号阿里云 Alibaba Cloud@alibaba_cloud
精选
阿里云在Agent Builder Day上宣布构建智能体原生云,集成Qwen和Wan模型家族、模型服务及智能体计算运行时。该运行时基于AMD EPYC处理器,专为智能体工作负载设计。活动有100+注册参会者,合作方包括HeyGen、Pika等。阿里云强调当前云架构为应用设计,智能体需要模型、运行时和基础设施协同设计的全新堆栈。

推荐理由:阿里云和AMD一起办了个Agent Builder Day,说现在的云不适合智能体,他们要搞一套专门为智能体设计的云,包括Qwen和Wan模型。
01:07
01:07官方账号Decoder@Matthias Bastian
72°
AMD向Anthropic投资高达50亿美元。作为协议一部分,Anthropic将部署2吉瓦MI450 GPU用于训练和运行Claude模型。这是AMD继Meta和OpenAI后的另一笔重大AI芯片交易,旨在挑战Nvidia的主导地位。批评者认为此类协议构成循环现金流动。
事件专题

推荐理由:AMD砸50亿美元给Anthropic换2吉瓦GPU订单,Claude要用AMD芯片了,和Nvidia抢生意。
7月21日
11:57
11:57官方账号arXiv cs.LG@Krish Agarwal, Zhuoming Chen, Yanyuan Qin, Zhenyu Gu, Atri Rudra, Beidi Chen
FlashRT 是一个引导编码智能体优化实时多模态应用部署的框架,将简单参考实现转化为多 GPU 部署。在 NVIDIA B200 GPU 上,FlashRT 将视频世界模型和多模态 LLM 的延迟降低达 70 倍,吞吐量提升 2.8 倍。在 AMD MI355X GPU 上,延迟降低持平,吞吐量提升达 3.6 倍。针对 Qwen3-Omni 文本到音频推理,FlashRT 在 AMD MI355X 上比专家 vLLM-Omni 实现减少 65% 响应延迟。
事件专题

推荐理由:部署多模态模型时延迟高吞吐低?FlashRT 让智能体自动优化,实测延时降 70 倍,吞吐升 3.6 倍,AMD 平台效果尤其猛。
7月13日
09:52
7月11日
6月18日
02:30
02:30官方账号Decoder@Matthias Bastian
73°
Amazon、Nvidia、AMD向世界模型初创公司Odyssey ML投资3.1亿美元,该公司估值达14.5亿美元。CIA关联基金IQT和谷歌首席科学家Jeff Dean也参与本轮融资。世界模型被业界视为语言模型后的下一个AI重点方向。
事件专题

推荐理由:亚马逊、英伟达、AMD都砸钱进这家3D世界模型公司,连Jeff Dean都跟投了,看来世界模型是下一波风口。
6月7日