Как работает распознавание текста (OCR) в Scan.Plus?

Scan.Plus использует технологию распознавания текста (OCR) для считывания текста с отсканированных страниц. Эта технология обеспечивает работу таких функций приложения, как поиск документов, умное присвоение имён и инструменты ИИ. Она не делает PDF-файлы редактируемыми и не добавляет в экспортированные файлы слой текста, доступный для выделения.

В Scan.Plus используются два отдельных процесса OCR, которые работают по-разному:

Локальное OCR (автоматическое, фоновое)

Локальное OCR запускается автоматически на вашем устройстве в процессе сканирования и сохранения документа. Для его активации не требуется никаких действий с вашей стороны.

Оно срабатывает в двух случаях:

  • При сканировании первой страницы — OCR считывает содержимое страницы, чтобы автоматически предложить название документа (умное присвоение имён).
  • При сохранении документа — OCR обрабатывает все страницы, чтобы текстовое содержимое документа стало доступным для поиска внутри приложения.

Что это значит для вас:

  • Вы можете искать документы в Scan.Plus по их текстовому содержимому, а не только по имени файла.
  • Распознанный текст сохраняется вместе с метаданными документа и также может использоваться функциями ИИ (например, в качестве контекста для ИИ-ассистента).
  • Этот процесс выполняется непосредственно на устройстве. Для данного типа OCR страницы документа не отправляются на сервер.
  • Распознанный текст используется только внутри приложения. Он не появляется в экспортированных PDF-файлах в виде выделяемого или видимого текстового слоя — экспортированные файлы являются изображениями.
  • Для уже сохранённых документов нет кнопки ручного запуска OCR или повторного распознавания текста.

Облачное OCR — Image to Text (ручное, интерактивное)

Второй тип OCR запускается вручную в процессе сканирования и предоставляет результат, который можно прочитать, скопировать и использовать напрямую.

Как этим пользоваться:

  1. Отсканируйте документ.
  2. В процессе сканирования нажмите «Содержимое».
  3. Нажмите «Image to Text».
  4. Scan.Plus загружает страницу на серверы обработки и возвращает распознанный текст.
  5. Вы можете прочитать, скопировать и поделиться результатом.

Что это значит для вас:

  • В отличие от локального OCR, здесь вы видите текстовый результат и можете с ним взаимодействовать.
  • Для использования этой функции требуется подключение к интернету, поскольку обработка происходит в облаке.
  • Функция Image to Text доступна только во время активного процесса сканирования — она недоступна для уже сохранённых документов в разделе «История».

Язык распознавания текста

Вы можете задать предпочитаемый язык OCR в приложении в разделе «Настройки» > «Настройки документа» > «Язык распознавания текста». Поддерживаемые языки: английский, французский, немецкий, итальянский, испанский, португальский, китайский, корейский, японский.

Выбор правильного языка для вашего документа повышает точность распознавания.


Доступность по тарифам

Автоматическое локальное OCR (поиск и умное присвоение имён) выполняется в рамках стандартного процесса сканирования и сохранения и не требует платного тарифа.

Облачное OCR (Image to Text) и функции, связанные с ИИ, могут зависеть от остатка средств на счёте или правил тарифа — актуальную доступность для вашего тарифа уточняйте в приложении.


Чего не делает OCR

  • Не делает экспортированные PDF-файлы доступными для текстового поиска и не добавляет в них выделяемый текст. Экспортированные файлы являются изображениями.
  • Не заменяет необходимость в чётком, хорошо освещённом скане — низкое качество изображения снижает точность распознавания.
  • Для документов, уже сохранённых в разделе «История», ручной запуск OCR недоступен.
Была ли эта статья полезной?
Пользователи, считающие этот материал полезным: 0 из 0
More Articles in this section