光学式文字認識 (OCR) は、画像、ビデオ、またはスキャンしたドキュメント (PDF など) から手書きまたは入力したテキストを抽出し、デジタル編集可能な形式 (TXT や DOCX など) に変換するプロセスです。このテクノロジーは、コンピューター ビジョンとパターン認識に密接に関連する人工知能の分野です。 OCR を使用すると、画像から印刷されたテキストをエンコードできるため、情報を電子的に変更、検索、およびよりコンパクトに保存できるようになります。また、この情報をオンラインで表示し、コグニティブ コンピューティングを含むマシン プロセスで利用することもできます。 OCR の用途は、個人利用から公共セキュリティまで多岐にわたります。 さらに、OCR テクノロジーは文書のデジタル化と管理の方法に革命をもたらしました。その機能には次のものが含まれます。 * スキャンされた文書の認識: 印刷された文書がスキャンされ、OCR ソフトウェアが検索および編集可能なテキストに変換します。これにより、ユーザーは古い文書から情報を抽出し、それを最新のワークフローに組み込むことができます。これは、法的文書の処理を自動化し、銀行取引明細書や請求書からデータを抽出するために一般的に使用され、請求書処理や財務記録管理などのタスクを合理化します。 * シーン テキスト認識: OCR は、道路標識、店頭、ナンバー プレートなどの自然シーン内のテキストを識別できます。薄暗い画像やぼやけた画像など、さまざまな条件下でも優れたパフォーマンスを発揮するため、ストリート アートのテキストやドローンで撮影された画像の認識に役立ちます。 * インテリジェント文字認識 (ICR): この機能により、OCR システムはスキャンされた文書から手書きまたは筆記体のテキストを認識して転写できるようになり、手書きのメモ、手紙、フォームのデジタル化が容易になります。 ICR は特に筆記体とスクリプトの手書き文字の転写に重点を置いています。