5月20日
18:28
18:28Skywork@Skywork_ai
Skywork 发布 SkyClaw-v1.0 智能体模型,专为 OpenClaw、Hermes 和 Nanobot 优化,具备更强的工具使用和多轮任务执行能力。该模型现已作为一级提供商正式集成到 nanobot 配置中,用户只需填入 API 密钥即可使用。同时推出的还有 SkyClaw-v1.0-lite,速度更快、成本更低。
事件专题

推荐理由:智能体开发者终于有了一个专门为工具调用和多轮任务优化的模型,直接接入 nanobot 就能用,做 agent 编排的团队建议试试。
11:24
11:24官方账号arXiv cs.LG@Emaad Khwaja, Chris Lettieri, Gerald Woo, Eden Belouadah, Marc Cenac, Guillaume Jarry, Enguerrand Paquin, Xunyi Zhao, Viktoriya Zhukov, Othmane Abou-Amal, Chenghao Liu, Ameet Talwalkar, David Asker
精选76°
Toto 2.0 是一系列开源时间序列基础模型,参数规模从 4M 到 2.5B,展示了单一训练配方即可实现预测质量的可靠提升。该模型家族在 BOOM、GIFT-Eval 和 TIME 三个基准上刷新了最先进水平。研究团队详细描述了架构、训练数据、超参数迁移管道等设计决策。所有五个基础检查点均以 Apache 2.0 许可证开源。这项工作标志着时间序列预测领域正式进入规模扩展时代。
推荐理由:时间序列预测终于有了可扩展的基础模型,做金融、能源、运维等预测任务的团队可以直接用开源权重,值得关注。
10:31
10:31官方账号arXiv cs.AI@Wen Shi, Zhe Wang, Huafei Huang, Qing Qing, Ziqi Xu, Qixin Zhang, Xikun Zhang, Renqiang Luo, Feng Xia
精选
TERGAD 是一种新型图异常检测框架,通过大语言模型将节点拓扑属性转化为自然语言描述,生成高维语义嵌入,再与原始节点特征自适应融合。该方法解决了现有文本增强方法忽略节点结构上下文的问题,能检测由内容与拓扑不一致导致的复杂异常。在六个真实数据集上,TERGAD 持续优于现有基线,消融实验验证了结构语义引导和门控融合机制的有效性。代码已开源。
推荐理由:做图异常检测的研究者终于有了一个能同时利用结构语义和文本特征的框架——TERGAD 用 LLM 把拓扑信息翻译成自然语言,比纯数值特征更易捕捉异常模式,建议做 GAD 的团队直接跑一下开源代码。
5月19日
11:11
11:11官方账号arXiv cs.LG@Stefano Riva, Yantao Luo, Carolina Introini, Antonio Cammi
pyforce 是一个用于多物理场问题数据驱动降阶建模的 Python 包,主要面向核工程领域。它是 ROSE 项目的一部分,旨在降低多物理场模型复杂度、优化传感器位置并集成实测数据以提升系统认知。1.0.0 版本完全重写,改用 pyvista 作为后端处理网格、积分和可视化,并将函数存储为 numpy 数组以提升易用性。新版本支持任何能导出 VTK 格式的求解器,大幅扩展了适用性。
推荐理由:核工程和计算物理领域的团队终于有了一个更易用的降阶建模工具——pyforce 1.0.0 摆脱了对特定求解器的依赖,做多物理场仿真的开发者可以直接集成到现有工作流中。
10:57
10:57官方账号arXiv cs.LG@Md Hasan, Nyvenn Castro, Daiqi Liu, Lukas Mulzer, Jana Hutter, Jonghye Woo, Moritz Zaiss, Andreas Maier, Paula A. Perez-Toro
精选
SIREM是一种新型的语音引导MRI重建框架,通过同步语音作为跨模态先验来改善实时语音MRI(rtMRI)的图像质量。该方法将每帧图像建模为音频驱动和MRI驱动成分的融合,利用语音预测发音器结构,同时从k空间数据重建互补内容。SIREM还引入了可学习的螺旋臂软加权机制,实现k空间采样与语音信息融合的差异化研究。在USC语音rtMRI基准上,SIREM在保持解剖学合理性的同时,显著优于传统方法(如网格化、小波压缩感知和全变分),实现了更高吞吐量的重建。代码已开源。
推荐理由:语音MRI研究者终于有了一个利用语音信号本身来提升成像质量的新思路——SIREM把音频作为先验,解决了传统rtMRI在分辨率与速度间的权衡问题,做语音科学或临床评估的团队可以直接用开源代码试试。
10:06
10:06官方账号arXiv cs.AI@Mingyang Rao, Kehua Feng, Zhihui Zhu, Jiangzhen Fu, Hao Yu, Keyan Ding, Huajun Chen
精选
大模型在理解化学反应图方面存在视觉缺陷和语义脱节两大瓶颈。ChemVA框架通过视觉锚点机制和语义对齐方法,将化学结构图转化为模型能理解的实体名称,显著提升理解能力。在OCRD-Bench基准测试中,ChemVA实现92%的结构识别准确率,并在9种不同大模型上平均提升约20个百分点,使开源模型在复杂化学推理任务上媲美闭源系统。
推荐理由:做化学信息学或AI辅助药物研发的团队,终于有了让大模型真正看懂反应图的方法——开源框架可直接用,效果提升明显。
5月18日
5月17日
07:31
07:31berryxia@berryxia
Vercel Labs 推出专为 AI Agent 设计的编程语言 Zero,由 Chris Tate 主导开发。Zero 从语言层面解决 Agent 编程中的幻觉和调试痛点,支持能力显式声明、JSON 格式诊断和类型安全自动修复。相比 Rust、Python 等通用语言,Zero 更小、更快、更易被 Agent 编写和维护。该项目已在 GitHub 开源,供开发者实验和贡献。
事件专题

推荐理由:Vercel 直接为 AI Agent 造了门新语言,解决了 Agent 写代码时幻觉多、修 bug 慢的痛点。做 Agent 开发或自动化工具的团队值得关注,可以直接上 GitHub 试试。