Автор:Николаева Ирина Год: 2011 Издание:LAP Lambert Academic Publishing Страниц: 256 ISBN: 9783843318488 Данная работа посвящена проблемам разработки лингвистического и алгоритмического обеспечения, служащего для создания современной системы извлечения ключевой содержательной информации посредством применения широкого класса математических и лингвистических методов логико-аналитической обработки больших символьных массивов. В рамках данного исследования разработана обобщенная схема обработки массива публицистических текстов для подъязыка СМИ, выявлены тенденции с учетом соответствия результатов обработки естественно-языкового текста, выполненной компьютером и человеком, предложена модель текста как композиция формальных моделей ее компонентов, в основе которой лежит интеграция статистических и формальных лингвистических методов, разработан алгоритм извлечения элементов смысла из массива текстов ограниченной тематики, включающий блок первичной семантической обработки, блок индексации и ранжирования понятий, блок установления связей, блок выявления тематического узла, блок установления...