本文へ移動

れんぞくちせいぎょ

連続値制御

ロボットの関節や自動運転車の操舵など、滑らかな動きを実現するために連続的な値を扱う制御です。

詳しい説明

連続値制御とは、あらかじめ決められた離散的な選択肢から選ぶのではなく、トルクや角度のように範囲内の任意の数値を調整する制御のことです。ロボットの関節駆動や自動運転車のステアリング操作など、細かく滑らかな動きが求められる場面で必須の技術となります。

強化学習においては、行動空間が連続であるため、離散的な行動選択を行う手法とは異なるアルゴリズムが必要になります。DDPGなどがこれに対応する手法として知られており、連続的な数値を出力できる仕組みを実装します。

G検定では強化学習の手法の分類として問われます。行動空間が離散的か連続的かによって適用できる手法が異なるため、その違いを理解しておくことが重要です。

試験で問われること

G検定

  • 連続値制御はロボットや自動運転で求められる技術。
  • 強化学習では連続的な行動空間を扱う手法が必要である。
  • 離散的な行動選択を行う手法とはアルゴリズムが異なる。