Optical Character Recognition (OCR) er prosessen med å trekke ut og konvertere håndskrevet eller maskinskrevet tekst fra bilder, videoer eller skannede dokumenter (som PDF-er) til et digitalt redigerbart format (som TXT eller DOCX). Denne teknologien er en gren av kunstig intelligens som er nært knyttet til datasyn og mønstergjenkjenning. OCR muliggjør koding av trykt tekst fra bilder, noe som gjør det mulig å elektronisk endre, søke og lagre informasjonen mer kompakt. Den lar også denne informasjonen presenteres online og brukes i maskinprosesser, inkludert kognitiv databehandling. Applikasjonene til OCR spenner over et bredt spekter, fra personlig bruk til offentlig sikkerhet. Videre har OCR-teknologi revolusjonert måten vi digitaliserer og administrerer dokumenter på. Dens evner inkluderer: * Gjenkjenning av skannet dokument: Utskrevne dokumenter skannes, og OCR-programvare konverterer dem til søkbar og redigerbar tekst. Dette gjør det mulig for brukere å trekke ut informasjon fra gamle dokumenter og integrere den i moderne arbeidsflyter. Det brukes ofte til å automatisere behandlingen av juridiske dokumenter og trekke ut data fra kontoutskrifter og fakturaer, strømlinjeforme oppgaver som fakturabehandling og regnskapsføring. * Scenetekstgjenkjenning: OCR kan identifisere tekst i naturlige scener, for eksempel gateskilt, utstillingsvinduer eller bilskilt. Den fungerer godt under ulike forhold, inkludert lite lys eller uskarpe bilder, noe som gjør den nyttig for å gjenkjenne tekst i gatekunst eller bilder tatt av droner. * Intelligent Character Recognition (ICR): Denne funksjonen lar OCR-systemer gjenkjenne og transkribere håndskrevet eller kursiv tekst fra skannede dokumenter, noe som letter digitaliseringen av håndskrevne notater, brev og skjemaer. ICR fokuserer spesielt på å transkribere kursiv og skripthåndskrift.