GPT-1を読む⑦入力変換

2024年6月19日 14:06

前回までに、OpenAIが2018年に発表したGPTの最初のバージョンの論文「Improving Language Understanding by Generative Pre-Training」のセクション３.２「教師ありファインチューニング」（Supervised fine-tuning）を読み終えました。

これによって、事前学習されたモデルを特定のタスクへと微調整するための目的関数を数学的に理解しました。

よって、これまでに、事前学習とファインチューニングの枠組みがわかったのですが、より具体的な言語タスクに対するイメージは、まだ湧わいてきません。

例えば、２つの入力文があるようなタスクに対してどのように対応できるのでしょうか。

そこで、今回はセクション３.３「タスク特有の入力変換」（Task-speciﬁc input transformations）を読み進めていきます。事前学習されたモデルを微調整するためのタスク特有の入力の仕方について解説しています。

下図の右側が今回フォーカスされる部分となります。

今回のセクションでは、モデル自体を大幅に変更することなく、特有の言語タスクに対応できることが理解できます。

ここから先は

9,842字 / 5画像

キカベン・読み放題

¥1,000 / 月

初月無料

人工知能、機械学習、ディープラーニング関連の用語説明、研究論文の概要、プログラミングの具体例などの読み応えのある新しい記事が月に４−５本ほど追加されます。また、気になるAIニュースや日常の雑観などは随時公開しています。

メンバー限定の会員証が発行されます
活動期間に応じたバッジを表示
メンバー限定掲示板を閲覧できます
メンバー特典記事を閲覧できます
メンバー特典マガジンを閲覧できます

このメンバーシップの詳細

ログイン

この記事が気に入ったらサポートをしてみませんか？