Jak działa rozpoznawanie tekstu (OCR) w Scan.Plus?

Scan.Plus wykorzystuje rozpoznawanie tekstu (OCR) do odczytywania tekstu ze skanowanych stron. Dzięki temu działają funkcje aplikacji, takie jak wyszukiwanie dokumentów, inteligentne nazewnictwo i narzędzia AI – nie sprawia to jednak, że pliki PDF stają się bezpośrednio edytowalne, ani nie dodaje warstwy tekstowej, którą można zaznaczyć, do eksportowanych plików.

W Scan.Plus działają dwa oddzielne procesy OCR, które działają w różny sposób:

Lokalny OCR (automatyczny, w tle)

Lokalny OCR działa automatycznie na urządzeniu podczas procesu skanowania i zapisywania. Nie trzeba nic robić, aby go uruchomić.

Uruchamia się w dwóch momentach:

  • Podczas skanowania pierwszej strony - OCR odczytuje zawartość strony, aby automatycznie zaproponować nazwę dokumentu (inteligentne nazewnictwo).
  • Podczas zapisywania dokumentu - OCR działa na wszystkich stronach, dzięki czemu zawartość tekstowa dokumentu staje się przeszukiwalna w aplikacji.

Co to oznacza w praktyce:

  • Dokumenty w Scan.Plus można wyszukiwać na podstawie ich zawartości tekstowej, a nie tylko nazwy pliku.
  • Wyodrębniony tekst jest przechowywany razem z metadanymi dokumentu i może być również wykorzystywany przez funkcje AI (na przykład jako kontekst dla Asystenta AI).
  • Ten proces działa na urządzeniu. W przypadku tego typu OCR strony dokumentu nie są wysyłane na serwer.
  • Wyodrębniony tekst jest wykorzystywany wewnętrznie przez aplikację. Nie pojawia się jako zaznaczalna ani widoczna warstwa tekstowa w eksportowanych plikach PDF - eksportowane pliki są oparte na obrazie.
  • Dla już zapisanych dokumentów nie ma ręcznego przycisku „Uruchom OCR” ani „Ponownie skanuj tekst”.

Chmurowy OCR - Image to Text (ręczny, interaktywny)

Drugi rodzaj OCR jest uruchamiany ręcznie podczas procesu skanowania i zwraca wynik, który można odczytać, skopiować i wykorzystać bezpośrednio.

Jak z niego korzystać:

  1. Zeskanuj dokument.
  2. Podczas procesu skanowania dotknij Zawartość.
  3. Dotknij Image to Text.
  4. Scan.Plus przesyła stronę na swoje serwery przetwarzające i zwraca wyodrębniony tekst.
  5. Wynik można odczytać, skopiować i udostępnić.

Co to oznacza w praktyce:

  • W przeciwieństwie do lokalnego OCR, wynik tekstowy jest widoczny i można z nim wchodzić w interakcję.
  • Ta funkcja wymaga połączenia z internetem, ponieważ przetwarzanie odbywa się w chmurze.
  • Image to Text jest dostępne tylko podczas aktywnego procesu skanowania - nie jest dostępne dla dokumentów już zapisanych w sekcji Historia.

Język rozpoznawania tekstu

Preferowany język OCR można ustawić w aplikacji w sekcji Ustawienia > Ustawienia dokumentu > Język rozpoznawania tekstu. Obsługiwane języki to angielski, francuski, niemiecki, włoski, hiszpański, portugalski, chiński, koreański i japoński.

Wybór odpowiedniego języka dla dokumentu poprawi dokładność rozpoznawania.


Dostępność w zależności od planu

Automatyczny lokalny OCR (wyszukiwanie i inteligentne nazewnictwo) działa w ramach standardowego procesu skanowania i zapisywania i nie jest ograniczony do płatnego planu.

Chmurowy OCR (Image to Text) oraz funkcje związane z AI mogą podlegać limitom kredytów lub zasadom planu - sprawdź w aplikacji aktualną dostępność dla swojego planu.


Czego OCR nie robi

  • Nie sprawia, że eksportowane pliki PDF stają się przeszukiwalne pod względem tekstu, ani nie dodaje zaznaczalnego tekstu do eksportowanych plików PDF. Eksportowane pliki są oparte na obrazie.
  • Nie zastępuje konieczności wykonania czystego, dobrze oświetlonego skanu - słaba jakość obrazu obniży dokładność rozpoznawania.
  • Nie ma ręcznego uruchamiania OCR dla dokumentów już zapisanych w Historii.
Czy ten artykuł był pomocny?
Liczba użytkowników, którzy uważają ten artykuł za przydatny: 0 z 0
More Articles in this section