PDF в текст в простой TXT-файл
Достаньте весь текст из PDF в обычный файл TXT, который открывается любой программой. Для PDF-сканов включится распознавание. Без водяных знаков.
- 1Загрузите PDF
- 2Проверьте настройки
- 3Скачайте результат
Шаг 1 из 3: загрузите PDF
Файл обрабатывается на нашем сервере: исходник удаляется сразу после обработки, результат хранится около 15 минут, чтобы вы успели скачать, и тоже удаляется. Мы не передаём файлы третьим лицам.
Зарегистрированным — повышенные лимиты на файлы, строки и запросы. Создать аккаунт или войти.
Ваш файл
Например: 1-5. Без номеров возьмём первые 300 страниц.
Что получится
Текст и абзацы
Строки собираются в абзацы, заголовки отделяются пустой строкой. Таблицы превращаются в текст, поэтому для них лучше «PDF в Excel».
Сканы
Если страница — картинка, мы распознаём её (русский и английский). Результат стоит проверить: цифры и фамилии особенно.
Кодировка
Файл в UTF-8: кириллица открывается правильно в Блокноте, Word и любых редакторах.
Карточки товаров — не один файл, а тысячи
Проверим описания, фото и SEO-теги всего каталога, исправим ошибки нейросетью — 30 дней бесплатно, без привязки карты.
Частые вопросы
Если не нашли ответ — напишите нам.
Да, без регистрации. Ограничения: до 20 МБ, до 300 страниц текстового PDF и до 10 страниц скана за раз.
Если у PDF нет нормального текстового слоя, текст не извлечь обычным способом. Оставьте включённым распознавание — оно прочитает страницы как картинки.
Нет, TXT — это чистый текст без шрифтов, таблиц и картинок. Чтобы сохранить оформление, используйте «PDF в Word».
Файл обрабатывается на нашем сервере: исходник удаляется сразу после обработки, результат хранится около 15 минут, чтобы вы успели скачать, и тоже удаляется. Мы не передаём файлы третьим лицам.