Powiedzmy sobie szczerze. Nikt nie lubi przychodzić do pracy by w kółko wypełniać formularze i przepisywać dane z dokumentów. Ciężko znaleźć szybszy sposób na zabicie zaangażowania i motywacji w zawodzie.
Całe szczęście dysponujemy obecnie narzędziami, które te codzienne, powtarzalne zadania biorą na siebie, zwalniając nas tym samym z przykrego obowiązku. OCR (z angielskiego optical character recognition, czyli optyczne rozpoznawanie znaków) o którym właśnie mowa, jest rozwiązaniem, które pomaga znacznie zminimalizować ten problem. Ta innowacja wykorzystywana jest przez wiele przedsiębiorstw od tych największych, po małe firmy dopiero wchodzące na rynek.
Czym jest OCR oraz jak działa przechwytywanie danych z dokumentów? O tym dowiecie się z naszego artykułu. Zapraszamy do czytania.
Jak działa OCR (optyczne rozpoznawanie znaków)?
OCR to program komputerowy, który za pomocą narzędzi sztucznej inteligencji potrafi przeczytać tekst zawarty na skanach dokumentów i przekonwertować go w formę pisemną. Dzięki temu w prosty sposób uzyskujemy możliwość edycji tekstu wewnątrz skanu, bądź zdjęcia.
Proces ten podzielony jest na kilka etapów:
- wczytanie pliku
- wyodrębnienie poszczególnych elementów (tekstu, elementów graficznych czy pustej przestrzeni)
- rozpoznanie wyodrębnionego tekstu
- przekazanie informacji o uzyskanym tekście
Narzędzie to porównuje zebrane treści z bazą wzorców, w której każdy symbol ma swój odpowiednik. W ten sposób OCR po zauważeniu znaku przypominającego kształtem daną literę, zapisze ją jako tekst. System ten jest inteligentny. Po zlokalizowaniu pierwszej litery lub cyfry, w następnej kolejności zacznie szukać ciągu znaków na prawo i lewo od niej. W przypadku gdy uda się znaleźć więcej niż jeden symbol, OCR porównuje odczytaną treść z wbudowanym słownikiem w poszukiwaniu słów. W ten sposób nawet jeśli niepoprawnie zostanie odczytana jedna litera, algorytm i tak zrozumie o jakie słowo nam chodziło.



