技巧Agent 与开发者17:50象棋LLM训练:混合8%推理数据提升性能,内化推理而不使用这个意外发现很有意思:混一点点推理数据,不改变推理过程,象棋AI就变强了。适合研究模型训练技巧的人。#Amjad Masad#chess LLM#推理模型#微调Amjad Masad@amasad原文稍后读已读值得跟进有用关注 Amjad Masad