Сканы, фотографии, PDF и таблицы
Как сохранить заголовки, списки и таблицы при OCR?
Обработайте PDF или изображение в OCR «Систента» и выберите подходящий экспорт: Markdown или DOCX для текста, XLSX для таблиц. Структуру сложного макета нужно сверить с оригиналом — точное воспроизведение оформления не гарантируется.
Короткий ответ
Запустите OCR и проверьте структуру документа
Для текстового документа выберите Markdown или DOCX, а для извлечённых таблиц — XLSX. OCR постарается сохранить смысловую структуру, но сложные колонки, вложенные списки, объединённые ячейки и исходное оформление нужно проверить после экспорта.
Контекст задачи
Что здесь обычно мешает
Сплошной распознанный текст теряет уровни заголовков, границы списков и связь между строками таблицы. Даже верные слова становятся неудобными для редактирования, импорта и дальнейшей публикации.
Рабочий пример
Как это выглядит на практике
Редактор обрабатывает скан отчёта и выгружает основной текст в Markdown, а таблицы отдельно проверяет в XLSX. Он сравнивает порядок разделов и восстанавливает объединённые ячейки по оригиналу.
Перед результатом
Что проверить именно в этой задаче
- Выберите формат экспорта под текст или табличные данные.
- Проверьте порядок заголовков, списков и колонок.
- Сверьте объединённые ячейки и сложное оформление с оригиналом.
Настройте под свою ситуацию
Один вопрос — разные рабочие сценарии
Выбор меняет пример на странице, но не создаёт дублирующий адрес.
Пошагово
Как получить результат в Систенте
-
Загрузите PDF, PNG, JPG, JPEG или WEBP в раздел документов.
-
Запустите OCR и дождитесь обработки всех страниц.
-
Сверьте текст, числа, заголовки и границы таблиц с оригиналом.
-
Скопируйте результат или экспортируйте его в Markdown, DOCX либо XLSX.
Что получится
Редактируемый документ вместо картинки
- Распознанный текст с сохранённой доступной структурой.
- Найденные таблицы и их содержимое.
- Экспорт в Markdown, DOCX или XLSX.
- Возможность проверить результат по страницам исходного файла.
Следующий вопрос
Связанные решения
Следующий шаг
Загрузите материал и проверьте на своей задаче
OCR стоит 1 рубль за обработанную страницу; распознанный документ можно экспортировать в Markdown, DOCX или XLSX.