8月11日
23:58
23:58Weaviate@weaviate_io
精选
Weaviate在Search Mode中引入effort参数,允许用户在medium、high、ultrahigh三档间选择,以权衡输出质量与计算成本。ultrahigh档在BRIGHT基准的5个子集上平均nDCG@10达到X,比medium提升Y,比混合搜索提升Z。该功能旨在让开发者根据应用需求灵活调整推理资源。

推荐理由:Weaviate给搜索模式加了effort档位,想省算力就选medium,要质量就上ultrahigh,BRIGHT基准上提升明显,做RAG的可以试试。
6月11日
11:28
11:28官方账号arXiv cs.AI@Jadelynn Dao, Milan Ganai, Yasmina Abukhadra, Ajay Sridhar, Mozhgan Nasr Azadani, Katie Luo, Clark Barrett, Jiajun Wu, Chelsea Finn, Marco Pavone
精选72°
DIRECT 是一个路由框架,利用多模态场景上下文为每个提示分配测试时计算资源,以改善成功-成本帕累托前沿。研究发现,在链式思维深度、模型大小和记忆历史三个缩放轴上,测试时计算并非均匀杠杆,不同轴带来不同能力增益。在 VLABench 和 RoboMME 上的实验表明,DIRECT 在物理 Franka 机械臂上匹配或超越更强模型的成功率,同时平均延迟降低高达 65%。该工作揭示了朴素缩放测试时计算的浪费性,为具身代理的部署提供了更高效的方案。
推荐理由:DIRECT 解决了具身规划中测试时计算资源浪费的问题,做机器人部署和 VLM 应用的团队可以直接参考其路由策略,在降低成本的同时保持性能。
5月21日