AI Terms Academy
生成式 AI · Generative AI

Fine-tuning

在已经训练好的大模型基础上,用自己领域的数据再训练一下,让它在你的任务上更专。

微调

进阶 · Intermediate#微调#训练

Plain-language definition

一句话定义

在已经训练好的大模型基础上,用自己领域的数据再训练一下,让它在你的任务上更专。

Original definition

英文原文定义

Fine-tuning adapts a pre-trained model to a specific task or domain by continuing training on a smaller, task-specific dataset.

Two levels

分难度讲解

入门版

大模型像「通才毕业生」,什么都会一点。微调就是「岗前培训」:用你公司的数据让它再学一阵,变成你这个领域的专家。

进阶版

全参数微调成本高,因此衍生出参数高效微调(PEFT):LoRA(低秩矩阵)、Adapter、Prefix Tuning、QLoRA。指令微调(SFT)+ RLHF 是 ChatGPT 类对齐的标准流程。

Real-world example

真实例子

拿 Llama 3 开源模型,用法律文书微调一下,就能做一个比通用模型更懂法律的助手。

Keep exploring

相关术语