本文へ移動

とうけいてききかいほんやく

統計的機械翻訳

過去の翻訳データから単語や句の対応関係を確率モデルとして学習し、翻訳を行う手法です。文法規則を人が記述するのではなく、大量の対訳データから自動的にルールを抽出します。

詳しい説明

統計的機械翻訳は、過去の翻訳データから単語や句の対応関係を確率モデルとして学習し、翻訳を行う手法です。ニューラル機械翻訳が登場する以前の主流技術であり、文法的なルールを人間が記述するのではなく、大量の対訳データから自動的に翻訳ルールを抽出する点が特徴です。

試験で問われること

G検定(ジェネラリスト検定)

  • 大量の対訳データから確率モデルを学習する点が問われます。
  • ルールベース翻訳との違いを理解しておきます。
  • ニューラル機械翻訳との置き換わりが進んでいる歴史的背景が重要です。