Перейти к содержанию

PDF в текст

Выберите PDF, извлеките выделяемый текст и при необходимости распознайте сканированные страницы с помощью локального OCR, а затем скопируйте результат или скачайте TXT-файл.

Выберите PDF

Перетащите или выберите один PDF. Извлечение текста и необязательный OCR выполняются локально в браузере.

Оставьте пустым для всех страниц. Используйте номера и диапазоны через запятую.

Извлечь текст

Сначала прочитайте существующий текст PDF, а затем при необходимости запустите OCR только для выбранных страниц без извлекаемого текста.

PDF в текст

Быстрый старт

1
Выберите PDF
2
Укажите страницы при необходимости
3
Извлеките текст и при необходимости распознайте сканы
4
Скопируйте или скачайте TXT

Частые сценарии

Копирование

перенесите выделяемый или отсканированный текст из PDF в заметки, письмо или другой редактор.

Выборочное извлечение

прочитайте или распознайте с помощью OCR только нужные страницы длинного PDF.

Архивирование

сохраните легкую TXT-копию локального PDF без загрузки файла.

Ввод и вывод

Ввод: один локальный PDF с выделяемым текстом, сканированными страницами или обоими типами содержимого.
Страницы: по умолчанию все или диапазон вроде 1-3,5.
Вывод: обычный текст, который можно скопировать или скачать как TXT.

Рекомендации по использованию

Оставьте OCR выключенным для выделяемого текста PDF. Включите его, если выбранные страницы являются сканами или изображениями.
Сначала извлеките небольшой диапазон страниц, если PDF длинный или необычный.
Очень большие PDF могут обрабатываться долго и упираться в лимиты памяти браузера или текста.

Ограничения и совместимость

OCR необязателен и запускается только для выбранных страниц без извлекаемого текста. Рукописный текст, сканы низкого разрешения и сложная компоновка могут снизить точность.
Обычный текст не сохраняет сложную верстку PDF, колонки, таблицы, шрифты или аннотации.
PDF с паролем или необычной структурой могут не обработаться, если PDF.js или браузер не смогут их декодировать.

Конфиденциальность и безопасность

Обработка выполняется в браузере. CrateX.app не загружает PDF или извлечённый текст. Когда OCR включён, для локального распознавания скачиваются языковые ресурсы; PDF и результаты остаются в памяти страницы и по умолчанию не синхронизируются.

Частые вопросы

9

Перейдите к следующему шагу с этими связанными инструментами.

Вся обработка инструментов выполняется локально в вашем браузере.