とうけいてききかいほんやく
統計的機械翻訳
過去の翻訳データから単語や句の対応関係を確率モデルとして学習し、翻訳を行う手法です。文法規則を人が記述するのではなく、大量の対訳データから自動的にルールを抽出します。
詳しい説明
統計的機械翻訳は、過去の翻訳データから単語や句の対応関係を確率モデルとして学習し、翻訳を行う手法です。ニューラル機械翻訳が登場する以前の主流技術であり、文法的なルールを人間が記述するのではなく、大量の対訳データから自動的に翻訳ルールを抽出する点が特徴です。
試験で問われること
G検定(ジェネラリスト検定)
- 大量の対訳データから確率モデルを学習する点が問われます。
- ルールベース翻訳との違いを理解しておきます。
- ニューラル機械翻訳との置き換わりが進んでいる歴史的背景が重要です。