5月30日
17:27
17:27官方一手marktechpost@Michal Sutter
精选72°
Genesis AI 于 2026 年 5 月 27 日发布了 Genesis World 1.0,这是一个包含物理、渲染、编译和工具四个组件的仿真平台。该平台在仿真与真实机器人部署之间实现了 0.8996 的皮尔逊相关系数,并将策略评估时间从超过 200 小时缩短至不到 0.5 小时。这一突破使得机器人基础模型的规模化评估成为可能,显著降低了研发成本和时间。

推荐理由:机器人研究者终于有了一个高保真、超高效的仿真评估平台——Genesis World 1.0 将评估时间从 200 小时压缩到半小时,做机器人基础模型和策略训练的团队可以直接用起来,大幅加速迭代。
5月26日
12:25
12:25官方账号arXiv cs.LG@Adina Scheinfeld, Haotan Zhang, Shang Mu, Rudolf L. M. van Herten, Lucas Stoffl, Ali Erturk, Zhuhao Wu, Johannes C. Paetzold
精选
该研究提出了一种针对光片荧光显微镜(LSM)的 3D 基础模型,通过在大规模多物种、多染色体的 3D 图像数据集上预训练,学习可迁移的体素表示。模型联合优化掩码重建和图像-文本对齐,显著降低了下游任务的标注需求,支持少样本分割、分类和去模糊。实验表明,该模型在标准指标和专家评估上均优于基线方法,展示了基础模型在 LSM 分析中减少标注负担并提升性能的潜力。代码和预训练权重已开源。
推荐理由:做生物影像分析的研究者终于有了一个能少标注、多任务的 3D 基础模型——少样本就能搞定分割、分类和去模糊,建议做 LSM 数据处理的团队直接试试开源的预训练权重。
5月25日
5月23日
08:27
08:27rohanpaul_ai@rohanpaul_ai
精选72°
Google 发表新论文,提出 SensorFM,一个基于 500 万人超过 1 万亿分钟未标记穿戴传感器数据训练的基础模型。该模型旨在学习人类生理活动的通用模式,而非仅处理孤立事件。SensorFM 在 35 项预测任务中的 34 项上超越了传统特征工程方法,涵盖心血管、代谢、心理健康、睡眠和生活方式等领域。研究表明,穿戴数据的价值在于先学习其内在结构,而非过早压缩为粗略摘要。

推荐理由:穿戴设备厂商和健康 AI 研究者终于有了一个通用基础模型,不用再为每个健康任务单独设计特征工程。做可穿戴健康分析的团队可以直接参考 SensorFM 的预训练思路,大幅降低模型开发成本。
5月22日
16:36
11:12
11:12官方账号arXiv cs.AI@Girish Narayanswamy, Maxwell A. Xu, A. Ali Heydari, Samy Abdel-Ghaffar, Marius Guerard, Kara Vaillancourt, Zhihan Zhang, Jake Garrison, Levi Albuquerque, Dimitris Spathis, Hong Yu, Hamid Palangi, Xuhai "Orson" Xu, David G. T. Barrett, Joseph Breda, Jed McGiffin, Yubin Kim, Yuwei Zhang, Naghmeh Rezaei, Samuel Solomon, Karan Ahuja, Tim Althoff, Jake Sunshine, Ming-Zher Poh, Benjamin Yetton, Ari Winbush, Nicholas B. Allen, James M. Rehg, Isaac Galatzer-Levy, Yun Liu, John Hernandez, Anupam Pathak, Conor Heneghan, Yuzhe Yang, Ahmed A. Metwally, Pushmeet Kohli, Mark Malhotra, Shwetak Patel, Xin Liu, Daniel McDuff
精选72°
研究人员提出了一种面向可穿戴健康数据的基础模型,该模型在来自500万参与者的超过1万亿分钟未标记传感器信号上进行了预训练。通过联合扩展模型容量和预训练数据量,该模型在35项健康预测任务上(涵盖心血管、代谢、睡眠、心理健康及生活方式等)表现出系统性性能提升。该模型支持少样本学习和生成能力,可稳健估计日常健康指标。研究还部署了一组LLM智能体来自动搜索基于模型嵌入的下游预测头,并展示了性能随LLM能力提升而增强。最后,将下游预测器集成到个人健康代理中,经1860次临床医生评分验证,模型响应更相关、更具上下文意识且更安全。
推荐理由:这项研究解决了可穿戴数据标注稀缺和个体差异大的核心难题,做健康AI或可穿戴设备开发的团队可以直接参考其预训练方法和少样本学习策略,值得关注。
5月20日
11:24
11:24官方账号arXiv cs.LG@Emaad Khwaja, Chris Lettieri, Gerald Woo, Eden Belouadah, Marc Cenac, Guillaume Jarry, Enguerrand Paquin, Xunyi Zhao, Viktoriya Zhukov, Othmane Abou-Amal, Chenghao Liu, Ameet Talwalkar, David Asker
精选76°
Toto 2.0 是一系列开源时间序列基础模型,参数规模从 4M 到 2.5B,展示了单一训练配方即可实现预测质量的可靠提升。该模型家族在 BOOM、GIFT-Eval 和 TIME 三个基准上刷新了最先进水平。研究团队详细描述了架构、训练数据、超参数迁移管道等设计决策。所有五个基础检查点均以 Apache 2.0 许可证开源。这项工作标志着时间序列预测领域正式进入规模扩展时代。
推荐理由:时间序列预测终于有了可扩展的基础模型,做金融、能源、运维等预测任务的团队可以直接用开源权重,值得关注。
5月11日
22:17
22:17官方账号百度 AI Baidu@Baidu_Inc
70°
百度发布了其最新基础模型ERNIE 5.1,基于ERNIE 5.0的预训练基础构建。该模型在搜索、推理、知识问答、创意写作和智能体能力上进行了升级,同时预训练成本仅为同类模型的约6%。这一进展可能显著降低大模型的训练门槛。

推荐理由:ERNIE 5.1以极低的预训练成本实现了能力的全面升级,这展示了高效模型优化的潜力,可能对行业降低成本具有示范意义。