#偏好学习
共 4 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「偏好学习」标签的资讯、产品与论文,按刊登时间排,新的在上。
7月3日
7月1日
论文10:39
Freeform Preference Learning 实现机器人多维度偏好操控想让机器人按你的偏好做事?FPL 把“快一点”“稳一点”这种主观要求变成可训练的奖励信号,效果比传统方法好 38%。
6月3日
5月26日
Info-Synth:主动查询合成框架优化偏好学习
偏好学习是许多决策系统的核心,但标注成本高。Info-Synth 解决了传统主动学习计算昂贵和反馈不可靠的问题,做推荐系统、人机交互或机器人调优的团队可以直接参考该方法来降低数据成本。