Данная работа посвящена проблемам разработки лингвистического и алгоритмического обеспечения, служащего для создания современной системы извлечения ключевой содержательной информации посредством применения широкого класса математических и лингвистических методов логико-аналитической обработки больших символьных массивов. В рамках данного исследования разработана обобщенная схема обработки массива публицистических текстов для подъязыка СМИ, выявлены тенденции с учетом соответствия результатов обработки естественно-языкового текста, выполненной компьютером и человеком, предложена модель текста как композиция формальных моделей ее компонентов, в основе которой лежит интеграция статистических и формальных лингвистических методов, разработан алгоритм извлечения элементов смысла из массива текстов ограниченной тематики, включающий блок первичной семантической обработки, блок индексации и ранжирования понятий, блок установления связей, блок выявления тематического узла, блок установления... Это и многое другое вы найдете в книге Автоматическая обработка символьной информации (Ирина Николаева)