全部动态
AI 相关资讯全量信息流 · 6327 条
9月10日
9月9日
Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails
研究解决了小模型模仿专家时的性能下降问题,提出了新的在线策略修正方法,让小模型在特定任务中更接近大模型表现。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档
研究解决了小模型模仿专家时的性能下降问题,提出了新的在线策略修正方法,让小模型在特定任务中更接近大模型表现。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档