Перейти к содержанию
Систент

Сканы, фотографии, PDF и таблицы

Как сохранить заголовки, списки и таблицы при OCR?

Обработайте PDF или изображение в OCR «Систента» и выберите подходящий экспорт: Markdown или DOCX для текста, XLSX для таблиц. Структуру сложного макета нужно сверить с оригиналом — точное воспроизведение оформления не гарантируется.

Короткий ответ

Запустите OCR и проверьте структуру документа

Для текстового документа выберите Markdown или DOCX, а для извлечённых таблиц — XLSX. OCR постарается сохранить смысловую структуру, но сложные колонки, вложенные списки, объединённые ячейки и исходное оформление нужно проверить после экспорта.

Контекст задачи

Что здесь обычно мешает

Сплошной распознанный текст теряет уровни заголовков, границы списков и связь между строками таблицы. Даже верные слова становятся неудобными для редактирования, импорта и дальнейшей публикации.

Рабочий пример

Как это выглядит на практике

Редактор обрабатывает скан отчёта и выгружает основной текст в Markdown, а таблицы отдельно проверяет в XLSX. Он сравнивает порядок разделов и восстанавливает объединённые ячейки по оригиналу.

Перед результатом

Что проверить именно в этой задаче

  • Выберите формат экспорта под текст или табличные данные.
  • Проверьте порядок заголовков, списков и колонок.
  • Сверьте объединённые ячейки и сложное оформление с оригиналом.

Настройте под свою ситуацию

Один вопрос — разные рабочие сценарии

Выбор меняет пример на странице, но не создаёт дублирующий адрес.

Пошагово

Как получить результат в Систенте

  1. Загрузите PDF, PNG, JPG, JPEG или WEBP в раздел документов.

  2. Запустите OCR и дождитесь обработки всех страниц.

  3. Сверьте текст, числа, заголовки и границы таблиц с оригиналом.

  4. Скопируйте результат или экспортируйте его в Markdown, DOCX либо XLSX.

Что получится

Редактируемый документ вместо картинки

  • Распознанный текст с сохранённой доступной структурой.
  • Найденные таблицы и их содержимое.
  • Экспорт в Markdown, DOCX или XLSX.
  • Возможность проверить результат по страницам исходного файла.

Следующий вопрос

Следующий шаг

Загрузите материал и проверьте на своей задаче

OCR стоит 1 рубль за обработанную страницу; распознанный документ можно экспортировать в Markdown, DOCX или XLSX.

Открыть Систент