Скан накладной, фотография акта, присланный «как есть» документ — данные оттуда часто нужны в Excel, а перепечатывать их вручную утомительно. Скажем честно сразу: со сканами есть нюансы, и идеального результата на любом файле не бывает. Но если документы однотипные, перенос всё равно можно сильно ускорить. Разберём, как.
Скан — это картинка
Главное отличие: цифровой PDF хранит «настоящий» текст, а скан или фото — это изображение. Данные из картинки достаются распознаванием (OCR), и его точность зависит от качества:
- ровный, контрастный скан распознаётся хорошо;
- мятая бумага, тени, перекос, печать поверх текста, рукописные пометки — ошибки неизбежны.
Поэтому идеального распознавания любого скана не обещает никто. Реалистичная цель — ускорить работу и оставить себе финальную проверку.
Что повышает точность
- Одинаковый макет. Одна форма, одно расположение таблицы во всех документах.
- Качество съёмки. Ровно, контрастно, без бликов и перекоса; скан лучше фото на телефон.
- Понятная структура. Где шапка, где позиции, где итог — чем чётче, тем лучше.
- Цифровой оригинал, если есть. Иногда документ можно получить сразу в цифровом PDF — это снимает половину проблем.
Как проверять результат
Распознанные данные стоит проверять — особенно числа и суммы. Удобный приём: складывать результат в Excel так, чтобы рядом было видно исходное значение, и выборочно сверять. На старте проверяйте чаще, дальше — выборочно.
Когда это окупается
Если однотипные сканы приходят регулярно, перенос из PDF в Excel экономит часы перепечатки. Инструмент собирает позиции в таблицу под ваш тип документа, а вы контролируете результат. Для разрозненных, каждый раз разных сканов автоматизация даёт меньше — это честно стоит учитывать.
Что прислать для оценки
- 2–3 реальных примера (можно обезличенных);
- примеры с разным качеством, если оно скачет;
- описание, какие колонки нужны на выходе.
Есть поток однотипных сканов? Пришлите пару примеров — оценим, насколько хорошо они распознаются, без обещаний на пустом месте.