PDF в текст — извлечь текст в TXT, без загрузки
Извлеките текстовый слой PDF как обычный текст прямо в браузере. Строки и абзацы восстанавливаются по положению текста; скопируйте его или скачайте файл .txt.
Преобразование в браузере · Без регистрации
Один PDF · до 30 МБ и 200 страниц · обработка на устройстве
Как пользоваться
- Выберите PDF с выделяемым текстом.
- Укажите страницы для чтения, например 1-3, 5, и решите, отмечать ли разрывы страниц.
- Нажмите «Извлечь текст», затем скопируйте результат или скачайте его как файл .txt в UTF-8.
Пример
Отчёт на 2 страницы → "--- Страница 1 --- Квартальный отчёт Первый абзац…" с пустыми строками между абзацами.
Подробности и ограничения
Текст берётся из собственного текстового слоя PDF через pdf.js. Фрагменты на одной базовой линии объединяются в строку, промежутки между словами становятся пробелами, а увеличенный межстрочный интервал начинает новый абзац. На многоколоночных страницах колонки могут перемешаться, а широкие промежутки в таблицах сохраняются как три пробела.
Поддерживается текст на китайском, японском и корейском. У сканированных страниц нет текстового слоя, поэтому они получаются пустыми; инструмент перечисляет их и даёт ссылку на OCR PDF. PDF читается на вашем устройстве.
FAQ
Почему извлечённый текст пустой?
Скорее всего, PDF — это скан или набор изображений, то есть в нём картинки текста, а не символы. Чтобы распознать текст, воспользуйтесь OCR PDF.
Почему некоторые слова слипаются или странно разрываются?
PDF хранит размещённые фрагменты текста, а не предложения. Пробелы и переводы строк угадываются по их положению, поэтому необычные шрифты, кернинг или колонки могут давать неидеальный результат.
Можно ли извлечь текст из PDF, защищённого паролем?
Не напрямую. Если вы знаете пароль, сначала снимите его с помощью «Разблокировать PDF», затем извлеките текст из разблокированной копии.
Похожие инструменты
Справочники по форматам
Страница инструмента обновлена: