Тысяча снимков без поиска — это не архив, а склад. Причём чем он больше, тем бесполезнее: найти конкретный документ становится дороже, чем запросить его заново.
Минимум, который окупается сразу: дата, источник, номер листа в имени. Работает даже без всяких программ.
Простая таблица: файл, что это, дата, ключевые имена. Пятнадцать минут на дело, а находится всё за секунды.
Полнотекстовый поиск прямо по содержимому. Лучший вариант, если документов много.
Если распознанный текст лежит отдельным файлом, он рано или поздно теряет связь с изображением: папки переименовывают, файлы перемещают. Текстовый слой живёт внутри самого документа и никуда не денется.
К тому же ошибка в текстовом слое не портит документ: страница остаётся оригинальной картинкой. В отдельном текстовом файле ошибка становится содержанием.
Начиная с нескольких десятков. До этого хватает внятных имён файлов.
Минимум в двух местах, одно из которых не дома. Оцифровка не спасает от пожара, если копия одна.
Нет. Разумнее распознавать то, по чему будете искать, а остальное держать снимками с описью.
Выцветшие чернила, штамп поверх текста, старая орфография — если инструмент проходит это, с остальным справится точно.
Разобрать страницу →