Разработаны методы и модели работы модуля аналитической обработки слабоструктурированных текстовых ресурсов и документов. Представлены алгоритмы сбора и классификации данных на базе технологий высокоскоростных вычислений. Предложены методы и алгоритмы обнаружения дублирования в текстовых документах. Построены абстрагированные модели для верификации распределенных алгоритмов