物体検出
画像や動画の中から特定のオブジェクト(物体)の位置と種類を自動的に特定するAI技術。バウンディングボックスと呼ばれる矩形領域で位置を指定し、その中身が何であるかを分類する。自動運転や防犯カメラ、工場の検品など幅広い分野で活用されており、深層学習の発展によってリアルタイムでの高精度な検出が実現している。
コンピュータビジョンに関するAI用語を11件掲載しています。意味や使い方、関連用語を一覧から確認できます。
画像や動画の中から特定のオブジェクト(物体)の位置と種類を自動的に特定するAI技術。バウンディングボックスと呼ばれる矩形領域で位置を指定し、その中身が何であるかを分類する。自動運転や防犯カメラ、工場の検品など幅広い分野で活用されており、深層学習の発展によってリアルタイムでの高精度な検出が実現している。
画像処理とは、デジタル画像をコンピュータで解析・加工し、情報の抽出や画質の改善を行う技術です。AIの発展に伴い、自動運転や医療診断などの分野で高度な認識や解析がリアルタイムで行われるようになっています。
セマンティックセグメンテーションは、画像内のすべてのピクセルに対して意味的なクラスを分類するコンピュータビジョンの技術です。物体検出とは異なり、物体の輪郭をピクセル単位で正確に特定できるため、自動運転や医療画像解析などで広く活用されています。
インスタンスセグメンテーションは、画像内の個々の物体(インスタンス)をピクセル単位で識別して検出するコンピュータビジョンの技術です。同じカテゴリの物体であっても、それぞれを「個別の物体」として分離して認識できるのが特徴で、自動運転や医療画像解析など高度な画像理解が必要な分野で広く活用されています。
バウンディングボックスとは、画像や動画内で特定の物体がどこにあるかを示す長方形の領域です。物体検出をはじめとするコンピュータビジョンの領域で広く活用され、AIに物体の位置と種類を学習させるアノテーションや、検出結果の可視化に不可欠な基礎技術です。
画像認識とは、デジタル画像や動画から何が写っているかをコンピュータが解析・識別する技術です。従来の画像処理技術から発展し、深層学習や畳み込みニューラルネットワークの導入により飛躍的に精度が向上しました。自動運転、医療画像診断、顔認証セキュリティなど幅広い分野で利用され、コンピュータビジョン領域の中核をなしています。
画像分類とは、入力された画像全体がどのようなカテゴリに属するかをコンピュータに判定させるAI技術です。例えば、写真に猫が映っているか犬が映っているかを自動で識別するタスクで広く使われており、画像認識の基本技術として多分野で活用されています。
画像分割(イメージセグメンテーション)とは、デジタル画像内の個々のピクセルを、共通の属性や意味を持つ領域ごとに分類・グループ分けするコンピュータビジョン技術です。画像全体から特定の対象物の境界を正確に特定することで、自動運転、医療画像診断、ロボットの視覚システムなど、高度な画像理解を伴う多様な分野で不可欠な技術となっています。
カラー量子化とは、画像内で使われている膨大な色数を、人間の視覚特性に配慮しつつ少数の代表色(パレット)へと削減する画像処理技術です。画質劣化を最小限に抑えながら画像データのファイルサイズを大幅に削減できるため、画像圧縮やWeb最適化において重要です。機械学習アルゴリズムであるk-means法などが代表色の選定に広く応用されています。
オブジェクト検出は、画像や動画の中から特定の対象物の位置を矩形枠で特定し、その種類を判別するAI技術です。単に何が写っているかを識別するだけでなく、画像内のどこに複数の対象が存在するかを同時に把握できます。自動運転や防犯システム、製造現場の検品など、迅速かつ正確な状況理解が必要な分野で幅広く活用されています。
畳み込みニューラルネットワーク(CNN)とは、主に画像や動画などの格子状データの処理に特化したディープラーニングの構造です。フィルターを用いた畳み込み処理とプーリング処理を組み合わせることで、データの局所的な特徴を効率的に抽出し、画像認識や物体検出などの分野で高い性能を発揮します。