AllSpark 新出的两个开源搜索代理,基于 Qwen,在工具使用和办公任务上表现不错,比其他开源模型强。
NVIDIA 定义 LLM 推理基准,AI 教育冲击加剧,量子计算与代理模型突破
2026年9月14日,AI领域迎来多领域突破:NVIDIA 正式发布 LLM 推理基准指标定义,为行业提供标准化评估体系;MIT 发布报告指出 AI 对本科教育的冲击,呼吁教育改革;图灵量子推出第三代光量子计算机;AllSpark 发布基于 Qwen 的开源搜索代理;蚂蚁灵波开源世界模型;亮源新创实现机器人导航零样本适配。同时,AI 安全与伦理议题升温,微软 CEO 纳德拉强调 AI 审慎发展,DeepMind 研究员警告 AI 巨大危害风险。
模型发布/更新
4 篇移动云和南湖研究院等联合发布的新系统,用类脑芯片和 GPU 协同,让 Deepseek V4 大模型推理更便宜,成本比同类国产方案低一半多。
Anthropic CEO Dario Amodei 发表文章,呼吁 AI 行业放慢速度,并承诺提供系统访问权限给第三方评估机构,这和之前的情况不同。
产品发布/更新
4 篇ElevenLabs 推出了 AI 音乐生成器 Music v2.5,能生成更受听众偏好的音乐,通过应用和 API 提供免费与专业版。
行业动态
4 篇DeepMind 的安全研究员离职警告,说未来五年内 AI 造成巨大危害的概率很高,还提到了递归自我提升这种技术,挺值得关注的。
工信部搞了个国家级算力平台,把全国 31 个省的算力都接上,能实时看全国算力运行情况,盘活资源,对行业监管和产业创新都有用。
微软 CEO 纳德拉发了条关于 AI 发展理念的内容,说 AI 需要加速发展,企业要掌握自己的知识,微软明日会公布《行为准则》,挺具体的。
论文研究
4 篇朋友,这是Yifan Zhang团队提出的一个新架构,叫Recurrent Looped Transformer (RLT),它通过让解码器循环处理每个token来提升效率,和传统模型比,在保持每个token计算成本不变的情况下,深度可以随序列增长,挺有意思的。
技巧与观点
4 篇NVIDIA 官方出了一套 LLM 推理指标体系,把 prefill 和 decode 阶段的延迟、吞吐等概念讲得特别清楚,对选型或容量规划很有帮助。
作为AI工程师,学习构建代理框架是保持领先并解锁独特价值的好方法。理解构建框架的知识可以用于调整任何框架,甚至应用领域专业知识构建特定领域的框架以解决可靠性问题。许多公司和初创公司已经开始这样做。虽然通用前沿模型在可验证任务上变得更好,但尚未解决在特定和动态环境中应用时的可靠性问题。依赖模型提供商构建框架可能导致供应商锁定。
朋友,有个叫Agency的本地AI小助手,能帮你找有用的事做,比如提醒你忘了的事,还能帮你提前解决麻烦,不用你一直发指令,挺方便的。