指令微调(Instruction Tuning)(2026.08.25)

概念编号:078

一句话理解

指令微调是把“人要模型做什么”和“理想答案应该怎样”做成示例,训练模型学会听指令。

具体解释

监督微调(SFT)通常使用人工或整理好的指令—回答数据,让模型从通用的续写能力,进一步变成更适合问答、总结、分类、代码等任务的助手。

边界与易混淆概念

  • 指令微调不等于预训练:它建立在已有模型底座之上。
  • 指令微调不等于所有对齐:偏好优化、安全训练和拒答策略也可能属于后训练。
  • 示例格式会影响行为:数据中的风格、错误和偏好可能一起被学到。

例子

给模型大量“请把这段话总结成三点—三点总结”的高质量样例,可以帮助它更稳定地执行总结指令。

相关概念

来源

概念卡更新日志

  • 2026.08.25|创建概念卡:依据 InstructGPT 的监督微调路径,登记为 078