Перейти к содержанию
Систент

Сканы, фотографии, PDF и таблицы

Как вытащить таблицу из сканированного PDF в Excel?

Обработайте PDF через OCR «Систента» и скачайте таблицу в Excel. При сложной вёрстке, нескольких таблицах или плохом скане проверьте границы и значения вручную.

Короткий ответ

Запустите OCR и проверьте структуру документа

Сканированный PDF можно обработать постранично и выгрузить распознанные таблицы в XLSX. При нескольких таблицах или сложной вёрстке необходимо проверить, как страницы, строки и столбцы распределились в файле.

Контекст задачи

Что здесь обычно мешает

В PDF-скане таблица является картинкой, поэтому обычный экспорт часто возвращает пустой результат. Сложные шапки и переносы между страницами могут нарушить структуру даже при верно прочитанных цифрах.

Рабочий пример

Как это выглядит на практике

Аналитик загружает отчёт в PDF, запускает OCR и открывает XLSX рядом с исходником. Он сверяет шапку, промежуточные итоги и переходы таблицы между страницами.

Перед результатом

Что проверить именно в этой задаче

  • Сравните число таблиц и строк с исходным PDF.
  • Проверьте многоуровневые заголовки и переносы между страницами.
  • Пересчитайте контрольные итоги после импорта.

Настройте под свою ситуацию

Один вопрос — разные рабочие сценарии

Выбор меняет пример на странице, но не создаёт дублирующий адрес.

Пошагово

Как получить результат в Систенте

  1. Загрузите PDF, PNG, JPG, JPEG или WEBP в раздел документов.

  2. Запустите OCR и дождитесь обработки всех страниц.

  3. Сверьте текст, числа, заголовки и границы таблиц с оригиналом.

  4. Скопируйте результат или экспортируйте его в Markdown, DOCX либо XLSX.

Что получится

Редактируемый документ вместо картинки

  • Распознанный текст с сохранённой доступной структурой.
  • Найденные таблицы и их содержимое.
  • Экспорт в Markdown, DOCX или XLSX.
  • Возможность проверить результат по страницам исходного файла.

Следующий вопрос

Следующий шаг

Загрузите материал и проверьте на своей задаче

OCR стоит 1 рубль за обработанную страницу; распознанный документ можно экспортировать в Markdown, DOCX или XLSX.

Открыть Систент