模型中美对照17:18ThinkingCap微调Qwen 27B实现2倍推理Token减少想给模型推理提速?这个ThinkingCap把Qwen 27B的思考token砍掉一半,有的例子快10倍,效果还很稳定。#ThinkingCap#Qwen#推理模型#微调Thomas Wolf@Thom_Wolf原文稍后读已读值得跟进有用关注 ThinkingCap