
説明
ボックス1:顔認識
画像内の顔や特徴を認識する顔検出機能、最大100万人の個人データベースから個人を特定する人物識別機能、幸福、軽蔑、中立、恐怖など、さまざまな表情を検出する感情認識機能、画像内の類似した顔の認識とグループ化機能。
ボックス2:OCR
ボックス3:物体検出
オブジェクト検出はタグ付けに似ていますが、APIは検出された各オブジェクトのバウンディングボックス座標(ピクセル単位)を返します。たとえば、画像に犬、猫、人物が含まれている場合、Detect操作はそれらのオブジェクトと画像内の座標を一覧表示します。この機能を使用して、画像内のオブジェクト間の関係を処理できます。また、画像内に同じタグが複数存在するかどうかを判断することもできます。
Detect API は、画像内で識別されたオブジェクトまたは生物に基づいてタグを適用します。現在、タグ付けの分類体系とオブジェクト検出の分類体系の間には正式な関係はありません。概念的には、Detect API はオブジェクトと生物のみを検出しますが、Tag API は次のような文脈用語も含めることができます。
「屋内」は、バウンディングボックスでは位置を特定できません。
参照:
https://azure.microsoft.com/en-us/services/cognitive-services/face/
https://docs.microsoft.com/en-us/azure/cognitive-services/computer-vision/concept-object-detection