AITOP6月11日 15:28
精选
过去 24 小时,从 682 条中筛出 42 条
6月11日
15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
15:07
AITOP6月11日 15:07
6月1日
00:09
AITOP6月1日 00:09
5月29日
5月28日
12:02
12:02
arXiv cs.LG@Krishnam Gupta
精选72°
推荐理由:做机器人 VLA 部署的团队注意了——不同架构的失败模式完全不同,用错监控等于白费功夫。建议直接看方向反转率这个通用指标,并试试 SafeContract 工具包。
5月15日
11:18
11:18
arXiv cs.LG@Will Schwarzer, Scott Niekum
精选
推荐理由:做AI安全评估的团队终于有了一个可量化的失败预测工具——新方法解决了评估集太小无法捕捉罕见失败模式的痛点,做模型部署前风险评估的开发者可以直接参考实验方法。
