Мгновенный текст — или честное «это скан»
Если у вашего PDF есть текстовый слой — а он есть у всего, что экспортировано из Word, браузера, LaTeX или системы выставления счетов, — текст извлекается за мгновения, показывается прямо на странице и готов к копированию в буфер или скачиванию как .txt. Без похода на сервер и без тревоги за размер: после разовой загрузки движка (~5 МБ) всё работает на вашем устройстве.
А когда текстового слоя в PDF нет, инструмент поступает честно: говорит, что файл — это скан и ему нужен OCR (распознавание текста), вместо того чтобы вручить .txt в ноль байт и назвать это успехом. Смешанные документы тоже получают честность по страницам: если страницы 4 и 7 — сканы внутри цифрового файла, результат так и скажет.