12:00宝玉@dotey78°候选人分享OpenAI软件工程师面试共五到六轮,包括两轮60分钟技术面、48小时take-home项目和四轮现场面试。新增的Agentic Coding Round(第六轮)要求用AI Coding Agent完成大型编程任务。面试重点考察分布式系统设计,例如设计ChatGPT、任务调度器和分布式webhook投递。候选人认为光刷LeetCode不够,还要会拆解大型问题交给AI Agent执行。行业OpenAIAgentic CodingChatGPT10 个信源在谈事件专题推荐理由:想去OpenAI?这篇面试全流程讲得很细,新增Agentic Coding轮考你用AI写代码,和刷LeetCode完全两码事。原文稍后读已读值得跟进有用关注 OpenAI
09:44官方账号arXiv cs.AI@Kai Yu, Lu Chen, Hanqi Li本文提出分布式智能体系统DAS,一种设备-边缘-云三层架构,用于异构智能体间的容错协作。系统定义智能体可靠性为系统级容错,而非单轮零错误准确率。架构包含两层:通过容错对齐实现单智能体执行可靠性,以及通过半形式化语言协议实现跨智能体通信可靠性。该框架为工业场景下异构具身智能体的可靠协作提供了工程路径。论文智能体分布式系统容错推荐理由:这篇论文提出了一个实用的容错框架DAS,专为工业场景下的异构智能体协作设计,解决了累积错误传播的老大难问题。原文稍后读已读值得跟进有用关注 智能体
13:28官方账号Soumith Chintala (PyTorch)@soumithchintalaPyTorch 创始人 Soumith Chintala 在 X 上发帖,为团队招募超算工程师,负责构建实时交互模型 Tinker 和大规模训练背后的基础设施。岗位涵盖调度、存储、网络、可靠性和分布式系统,工作地点在纽约和旧金山。这标志着 AI 基础设施领域对高端工程人才的需求持续增长。行业超算工程师GPU集群分布式系统推荐理由:如果你擅长 GPU 集群和分布式系统,这是直接参与下一代实时交互模型基础设施的机会,建议关注。原文稍后读已读值得跟进有用关注 超算工程师
01:59rohanpaul_ai@rohanpaul_ai72°Apodex-1.0-H 是一个用于深度研究的重型智能体团队,通过将网络研究任务分配给多个智能体,并在生成答案前审计每条证据链,声称达到 SOTA 结果。它将深度研究视为 AI 智能体的分布式系统问题:一个编排器分配子智能体不同的上下文和工具,然后事实核查、冲突审查和草稿审查智能体测试薄弱声明。真正的亮点在于,Apodex 展示了一条可能的“推理时扩展”路径,即更好的答案不是来自更大的模型,而是来自多个协调的搜索智能体、持久追踪和独立的验证层。AI产品智能体深度研究推理时扩展推荐理由:做深度研究或复杂信息检索的开发者,值得关注 Apodex 的分布式智能体思路——它可能改变“大模型=好答案”的惯性认知,用多智能体协作+验证层来提升结果可信度。原文稍后读已读值得跟进有用关注 智能体
11:05官方账号arXiv cs.LG@Abdurakhmon Sadiev, Artavazd Maranjyan, Ivan Ilin, Peter Richtárik精选Muon 作为 AdamW 的替代方案在神经网络训练中表现出色,但基于线性最小化预言机(LMO)的方法通常采用同步训练,在异构分布式系统中受限于慢速工作节点。本文提出 Ringmaster LMO,一种异步 LMO 动量方法,借鉴 Ringmaster ASGD 的延迟阈值思想,通过丢弃过时梯度实现最优时间复杂度。该方法在广义 (L0, L1)-光滑性下建立了收敛保证,并开发了参数无关的变体。实验表明,在随机二次问题和 NanoChat 语言模型预训练中,Ringmaster LMO 在异构环境下显著优于同步和异步基线。论文异步训练分布式系统优化算法推荐理由:分布式训练团队终于有了异步 LMO 方法的理论保障——Ringmaster LMO 解决了异构集群中慢节点拖累效率的问题,做大规模预训练或异构系统优化的开发者值得关注。原文稍后读已读值得跟进有用关注 异步训练