本文へ移動

だいきぼげんごもでる

大規模言語モデル (LLM)

LLM = Large Language Models

膨大なテキストを学習し、人間のように自然な文章を生成するモデルです。Transformerを基盤とし、ファインチューニングやプロンプトエンジニアリングで活用されます。

詳しい説明

膨大なテキストデータを学習し、人間のように自然な文章を生成・理解するニューラルネットワークモデルです。Transformerというアーキテクチャが基盤となっており、言語の意味や文脈を深く捉える能力を備えています。

数千億単位のパラメータを持ち、事前学習後に特定のタスクへ適応させるファインチューニングや、少数の例を示すだけでタスクを遂行させるプロンプトエンジニアリングが活用されます。単なる文章生成だけでなく、要約や翻訳、コード作成など幅広い用途で利用されています。

G検定では生成AIの代表格として頻出します。従来の手法との違いや、ハルシネーションと呼ばれる「もっともらしい嘘をつく」という課題への理解が重要です。AI倫理や著作権といった社会的側面とセットで問われることが増えています。

試験で問われること

G検定

  • 膨大なパラメータ数を持つニューラルネットワークモデルである。
  • ファインチューニングやプロンプトエンジニアリングにより活用される。
  • ハルシネーションという誤情報を生成する課題がある。