指示チューニングとは
指示チューニング(Instruction Tuning)は、事前学習済みのモデルに「指示 → 望ましい応答」の例を大量に学習させ、対話や作業指示に従えるようにする工程です。ChatGPTのような対話型サービスが成り立つのはこの段階のおかげです。
「指示と望ましい応答」の組でモデルを追加学習させ、人の指示に従えるようにする段階。
指示チューニング(Instruction Tuning)は、事前学習済みのモデルに「指示 → 望ましい応答」の例を大量に学習させ、対話や作業指示に従えるようにする工程です。ChatGPTのような対話型サービスが成り立つのはこの段階のおかげです。