Scan.Plus wykorzystuje rozpoznawanie tekstu (OCR) do odczytywania tekstu ze skanowanych stron. Dzięki temu działają funkcje aplikacji, takie jak wyszukiwanie dokumentów, inteligentne nazewnictwo i narzędzia AI – nie sprawia to jednak, że pliki PDF stają się bezpośrednio edytowalne, ani nie dodaje warstwy tekstowej, którą można zaznaczyć, do eksportowanych plików.
W Scan.Plus działają dwa oddzielne procesy OCR, które działają w różny sposób:
Lokalny OCR (automatyczny, w tle)
Lokalny OCR działa automatycznie na urządzeniu podczas procesu skanowania i zapisywania. Nie trzeba nic robić, aby go uruchomić.
Uruchamia się w dwóch momentach:
- Podczas skanowania pierwszej strony - OCR odczytuje zawartość strony, aby automatycznie zaproponować nazwę dokumentu (inteligentne nazewnictwo).
- Podczas zapisywania dokumentu - OCR działa na wszystkich stronach, dzięki czemu zawartość tekstowa dokumentu staje się przeszukiwalna w aplikacji.
Co to oznacza w praktyce:
- Dokumenty w Scan.Plus można wyszukiwać na podstawie ich zawartości tekstowej, a nie tylko nazwy pliku.
- Wyodrębniony tekst jest przechowywany razem z metadanymi dokumentu i może być również wykorzystywany przez funkcje AI (na przykład jako kontekst dla Asystenta AI).
- Ten proces działa na urządzeniu. W przypadku tego typu OCR strony dokumentu nie są wysyłane na serwer.
- Wyodrębniony tekst jest wykorzystywany wewnętrznie przez aplikację. Nie pojawia się jako zaznaczalna ani widoczna warstwa tekstowa w eksportowanych plikach PDF - eksportowane pliki są oparte na obrazie.
- Dla już zapisanych dokumentów nie ma ręcznego przycisku „Uruchom OCR” ani „Ponownie skanuj tekst”.
Chmurowy OCR - Image to Text (ręczny, interaktywny)
Drugi rodzaj OCR jest uruchamiany ręcznie podczas procesu skanowania i zwraca wynik, który można odczytać, skopiować i wykorzystać bezpośrednio.
Jak z niego korzystać:
- Zeskanuj dokument.
- Podczas procesu skanowania dotknij Zawartość.
- Dotknij Image to Text.
- Scan.Plus przesyła stronę na swoje serwery przetwarzające i zwraca wyodrębniony tekst.
- Wynik można odczytać, skopiować i udostępnić.
Co to oznacza w praktyce:
- W przeciwieństwie do lokalnego OCR, wynik tekstowy jest widoczny i można z nim wchodzić w interakcję.
- Ta funkcja wymaga połączenia z internetem, ponieważ przetwarzanie odbywa się w chmurze.
- Image to Text jest dostępne tylko podczas aktywnego procesu skanowania - nie jest dostępne dla dokumentów już zapisanych w sekcji Historia.
Język rozpoznawania tekstu
Preferowany język OCR można ustawić w aplikacji w sekcji Ustawienia > Ustawienia dokumentu > Język rozpoznawania tekstu. Obsługiwane języki to angielski, francuski, niemiecki, włoski, hiszpański, portugalski, chiński, koreański i japoński.
Wybór odpowiedniego języka dla dokumentu poprawi dokładność rozpoznawania.
Dostępność w zależności od planu
Automatyczny lokalny OCR (wyszukiwanie i inteligentne nazewnictwo) działa w ramach standardowego procesu skanowania i zapisywania i nie jest ograniczony do płatnego planu.
Chmurowy OCR (Image to Text) oraz funkcje związane z AI mogą podlegać limitom kredytów lub zasadom planu - sprawdź w aplikacji aktualną dostępność dla swojego planu.
Czego OCR nie robi
- Nie sprawia, że eksportowane pliki PDF stają się przeszukiwalne pod względem tekstu, ani nie dodaje zaznaczalnego tekstu do eksportowanych plików PDF. Eksportowane pliki są oparte na obrazie.
- Nie zastępuje konieczności wykonania czystego, dobrze oświetlonego skanu - słaba jakość obrazu obniży dokładność rozpoznawania.
- Nie ma ręcznego uruchamiania OCR dla dokumentów już zapisanych w Historii.