模型生命周期

微调(Fine-tuning)

在已完成预训练的模型基础上做进一步训练,使其行为专精于某项任务、某种风格或某家公司自有的数据。

预训练教会模型语言和通用知识,而微调则塑造模型如何运用这些知识:听从指令、拒绝不安全的请求、匹配品牌语气,或是精通法律文件审阅这类具体任务。

微调比预训练便宜得多,因为它是在一个已经具备能力的模型基础上进行的,只需要规模小得多、也更有针对性的数据集——往往只是几千个样本,而不是万亿级别。