Разработаны методы статистического анализа корпуса казахских текстов. Сформирована семантическая карта слов казахского языка. Построены вероятностно-статистические модели, отражающие семантическую структуру казахского языка на уровне лексических парадигм, и синтаксическая языковая модель казахского языка в рамках грамматики связей. Представлены методы предобработки текстовой информации на казахском языке и статистической обработки текстов на казахском языке, а также метод тематической категоризации текста на основе объединения семантических карт и иерархической агломеративной кластеризации и метод улучшения качества поисковой выдачи. *