Fine-tuning(微调)是一种机器学习技术,通过在预训练模型的基础上使用特定任务的数据进行额外训练,使模型适应特定应用场景。它是连接通用大语言模型与实际部署的关键步骤,近年来在定制化、性能提升和安全性等方面备受关注。
Fine-tuning 近期进展
当前焦点与观察点
当前 fine-tuning 领域呈现两极化趋势:一方面,商业平台不断简化微调流程,支持视觉、蒸馏等新能力,推动模型快速定制;另一方面,学术界和业界开始质疑微调的效果边界,如 CWE-Trace 所揭示的漏洞检测失效问题。此外,微调数据的质量与选取策略成为关键——FaceMind 实验表明,使用高频词汇进行微调比生僻高级词更有效,这挑战了传统数据筛选观念。同时,开源模型微调后的安全风险(如被用于恶意用途)也引发担忧,OpenAI 在评估开源 LLM 最坏前沿风险时强调了微调可能放大潜在危害。未来,如何平衡微调的效率与可靠性,以及建立更严谨的评估框架,将是重点方向。