画像認識ソフトウェアはコンピューター ビジョンとも呼ばれ、アプリケーションが画像やビデオを解釈できるようにします。画像を入力として処理し、コンピューター ビジョン アルゴリズムを通じてラベルや境界ボックスなどの出力を生成します。これには、画像復元、オブジェクト認識、シーン再構築などのさまざまな機能が含まれており、通常はインテリジェント アプリケーションに統合されます。データ サイエンティストは画像認識ソフトウェアを利用してモデルをトレーニングし、開発者は画像認識機能をソフトウェアに組み込みます。このソフトウェアにアクセスする形式は、機械学習ライブラリやフレームワークから API、SDK、エンドツーエンド プラットフォームに至るまで、ユーザーのニーズに応じて異なります。 画像認識ソフトウェアと関連ツールを区別することが重要です。データ サイエンスと機械学習のプラットフォームは、コンピューター ビジョン モデルをトレーニングするための機能を提供しますが、より広範な焦点を当てています。さらに、画像認識は機械学習の一種ではありますが、推奨エンジンやパターン認識などの他の機械学習機能とは異なります。テキスト認識ソフトウェアは、光学式文字認識 (OCR) カテゴリに分類されます。 多くの画像認識ソフトウェアは複数の目的を果たしますが、ロゴ検出、顔認識、オブジェクト検出、露骨なコンテンツ検出などの特定の領域に特化したソフトウェアもあります。画像ファイルのみを処理することも、画像とビデオの両方を処理することもできます。さらに、ほとんどはクラウドで動作しますが、エッジまたはオンデバイス処理をサポートするものもあります。 画像認識カテゴリに含めるには、製品は次の条件を満たす必要があります。 * 画像認識に合わせたディープラーニングアルゴリズムを提供します。 * 特定の機能やソリューションを学習するための画像データ プールとのインターフェース。 * 画像データを入力として受け入れ、ソリューションを出力として提供します。 * 他のアプリケーション、プロセス、またはサービスの画像認識機能を有効にします。