OCR to technologia optycznego rozpoznawania znaków, czyli analiza obrazu (np. skanu dokumentu lub zdjęcia strony) w celu wykrycia liter i zamiany ich na tekst cyfrowy. Efektem działania OCR jest zwykle dokument, w którym tekst można edytować, kopiować oraz wyszukiwać (np. eksport do TXT, DOCX albo PDF z warstwą tekstową).
Dlatego poprawna jest odpowiedź: "utworzenie edytowalnego dokumentu tekstowego." – bo to opisuje kluczowy rezultat OCR: przejście od obrazu do znaków.
Dlaczego pozostałe odpowiedzi są niepoprawne?
- "pozbycie się szumów na skanowanym materiale" – odszumianie to filtracja/retusz obrazu. Może poprawić czytelność i pośrednio podnieść skuteczność OCR, ale nie jest istotą działania OCR.
- "powiększenie rozdzielczości skanowanego materiału" – zwiększanie rozdzielczości to interpolacja lub ponowne skanowanie w wyższym DPI. OCR nie "dodaje pikseli"; analizuje istniejący obraz i rozpoznaje znaki.
- "zmniejszenie wielkości pliku zawierającego zeskanowany materiał" – to kompresja (np. JPEG, JBIG2, ZIP) lub optymalizacja zapisu. OCR może czasem wpłynąć na strukturę pliku (np. PDF z tekstem), ale jego podstawowym celem nie jest redukcja rozmiaru.
Wskazówka egzaminacyjna: jeśli w odpowiedziach pojawia się "tekst edytowalny", "rozpoznawanie znaków", "wyszukiwanie w skanie" – to typowe skojarzenia z OCR. Natomiast "szumy", "rozdzielczość", "zmniejszenie pliku" zwykle dotyczą narzędzi obróbki obrazu lub kompresji, nie rozpoznawania tekstu.