模型精选13:14混入8%推理轨迹让象棋LLM达到1300 ELO他试了在象棋AI数据里掺8%的推理数据,效果直接碾压纯数据,轻松上1300分。#象棋AI#推理模型#训练技巧#Elo评分Amjad Masad@amasad原文稍后读已读值得跟进有用关注 象棋AI
技巧Agent 与开发者精选04:12后训练新技巧:短任务训练即可扩展长周期智能体8-32倍这篇帖子讲了个后训练小诀窍:短任务训练就能让智能体扩展到8-32倍的长周期,省时省力,值得试试。#post-training#long-horizon agents#short tasks#智能体elvis@omarsar0原文稍后读已读值得跟进有用关注 post-training