Экспертные заключения: 0
Консультации: 0

Система аналитики архивных документов на базе компьютерного зрения и NLP

С каждым годом в архивах Москвы становится все меньше опытных специалистов, которые способны быстро и качественно читать дореволюционные рукописные документы. Растущая популярность генеалогии накладывает на архив дополнительные требования по быстрому и качественному поиску информации.

Значительный объем бумажных документов, передаваемых на архивное хранение, требует проведение первичной обработки и подготовки данных перед загрузкой в информационную систему архива. Извлечение и индексирование информации из гибридных документов (рукописный и машинописный тексты) позволит существенно увеличить скорость приема документов.

Мы хотим разработать веб-сервис с применением средств искусственного интеллекта, который позволит архивам Москвы в автоматизированном режиме извлекать из образов архивных документов данные, индексировать их и наполнять базу данных.


Ссылка

На страницу проекта

Направление

IT, Гос. управление

Рынки

TechNet, NeuroNet

Сквозные технологии

Технологии хранения и анализа больших данных