#Freeform Preference Learning
共 2 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「Freeform Preference Learning」标签的资讯、产品与论文,按刊登时间排,新的在上。
7月3日
7月1日
论文10:39
Freeform Preference Learning 实现机器人多维度偏好操控想让机器人按你的偏好做事?FPL 把“快一点”“稳一点”这种主观要求变成可训练的奖励信号,效果比传统方法好 38%。
想让机器人按你的偏好做事?FPL 把“快一点”“稳一点”这种主观要求变成可训练的奖励信号,效果比传统方法好 38%。