本文へ移動

いっぱんぶったいにんしき

一般物体認識

画像データの中に写っている対象が何であるかを分類するタスクです。犬や車などのカテゴリーを識別します。畳み込みニューラルネットワークの発展により、劇的な精度向上を達成しました。

詳しい説明

一般物体認識とは、画像や映像の中に「何が写っているか」を、あらかじめ決められた複数のカテゴリーの中から識別するタスクです。犬、猫、車、飛行機など、対象が何であるかを分類することが主な目的です。

畳み込みニューラルネットワークの発展により、このタスクの性能は飛躍的に向上しました。現在では、大量のデータセットを学習させることで、人間と同等、あるいはそれ以上の精度で物体を分類することが可能になっています。自動運転や防犯カメラの映像解析などで広く応用されています。

G検定では、特定の物体だけを認識する「特定物体認識」との違いが問われることがあります。また、この性能を競うコンテスト(ILSVRCなど)や、それを支える畳み込みニューラルネットワークの仕組みとの関わりをセットで理解しておく必要があります。

試験で問われること

G検定

  • 画像の中に何が写っているかを分類するタスクであることを理解する
  • 畳み込みニューラルネットワークが技術的な基盤であることを覚える
  • 特定物体認識との違いを把握する