Scan.Plus использует технологию распознавания текста (OCR) для считывания текста с отсканированных страниц. Эта технология обеспечивает работу таких функций приложения, как поиск документов, умное присвоение имён и инструменты ИИ. Она не делает PDF-файлы редактируемыми и не добавляет в экспортированные файлы слой текста, доступный для выделения.
В Scan.Plus используются два отдельных процесса OCR, которые работают по-разному:
Локальное OCR (автоматическое, фоновое)
Локальное OCR запускается автоматически на вашем устройстве в процессе сканирования и сохранения документа. Для его активации не требуется никаких действий с вашей стороны.
Оно срабатывает в двух случаях:
- При сканировании первой страницы — OCR считывает содержимое страницы, чтобы автоматически предложить название документа (умное присвоение имён).
- При сохранении документа — OCR обрабатывает все страницы, чтобы текстовое содержимое документа стало доступным для поиска внутри приложения.
Что это значит для вас:
- Вы можете искать документы в Scan.Plus по их текстовому содержимому, а не только по имени файла.
- Распознанный текст сохраняется вместе с метаданными документа и также может использоваться функциями ИИ (например, в качестве контекста для ИИ-ассистента).
- Этот процесс выполняется непосредственно на устройстве. Для данного типа OCR страницы документа не отправляются на сервер.
- Распознанный текст используется только внутри приложения. Он не появляется в экспортированных PDF-файлах в виде выделяемого или видимого текстового слоя — экспортированные файлы являются изображениями.
- Для уже сохранённых документов нет кнопки ручного запуска OCR или повторного распознавания текста.
Облачное OCR — Image to Text (ручное, интерактивное)
Второй тип OCR запускается вручную в процессе сканирования и предоставляет результат, который можно прочитать, скопировать и использовать напрямую.
Как этим пользоваться:
- Отсканируйте документ.
- В процессе сканирования нажмите «Содержимое».
- Нажмите «Image to Text».
- Scan.Plus загружает страницу на серверы обработки и возвращает распознанный текст.
- Вы можете прочитать, скопировать и поделиться результатом.
Что это значит для вас:
- В отличие от локального OCR, здесь вы видите текстовый результат и можете с ним взаимодействовать.
- Для использования этой функции требуется подключение к интернету, поскольку обработка происходит в облаке.
- Функция Image to Text доступна только во время активного процесса сканирования — она недоступна для уже сохранённых документов в разделе «История».
Язык распознавания текста
Вы можете задать предпочитаемый язык OCR в приложении в разделе «Настройки» > «Настройки документа» > «Язык распознавания текста». Поддерживаемые языки: английский, французский, немецкий, итальянский, испанский, португальский, китайский, корейский, японский.
Выбор правильного языка для вашего документа повышает точность распознавания.
Доступность по тарифам
Автоматическое локальное OCR (поиск и умное присвоение имён) выполняется в рамках стандартного процесса сканирования и сохранения и не требует платного тарифа.
Облачное OCR (Image to Text) и функции, связанные с ИИ, могут зависеть от остатка средств на счёте или правил тарифа — актуальную доступность для вашего тарифа уточняйте в приложении.
Чего не делает OCR
- Не делает экспортированные PDF-файлы доступными для текстового поиска и не добавляет в них выделяемый текст. Экспортированные файлы являются изображениями.
- Не заменяет необходимость в чётком, хорошо освещённом скане — низкое качество изображения снижает точность распознавания.
- Для документов, уже сохранённых в разделе «История», ручной запуск OCR недоступен.