КАТЕГОРИИ: Архитектура-(3434)Астрономия-(809)Биология-(7483)Биотехнологии-(1457)Военное дело-(14632)Высокие технологии-(1363)География-(913)Геология-(1438)Государство-(451)Демография-(1065)Дом-(47672)Журналистика и СМИ-(912)Изобретательство-(14524)Иностранные языки-(4268)Информатика-(17799)Искусство-(1338)История-(13644)Компьютеры-(11121)Косметика-(55)Кулинария-(373)Культура-(8427)Лингвистика-(374)Литература-(1642)Маркетинг-(23702)Математика-(16968)Машиностроение-(1700)Медицина-(12668)Менеджмент-(24684)Механика-(15423)Науковедение-(506)Образование-(11852)Охрана труда-(3308)Педагогика-(5571)Полиграфия-(1312)Политика-(7869)Право-(5454)Приборостроение-(1369)Программирование-(2801)Производство-(97182)Промышленность-(8706)Психология-(18388)Религия-(3217)Связь-(10668)Сельское хозяйство-(299)Социология-(6455)Спорт-(42831)Строительство-(4793)Торговля-(5050)Транспорт-(2929)Туризм-(1568)Физика-(3942)Философия-(17015)Финансы-(26596)Химия-(22929)Экология-(12095)Экономика-(9961)Электроника-(8441)Электротехника-(4623)Энергетика-(12629)Юриспруденция-(1492)Ядерная техника-(1748) |
Построение дерева зависимостей
Анализ целого текста на всех уровнях Понимание текста как его интерпретация в терминах цепочек предикатных структур Любой текст данной предметной области, порождающий цепочку предикатных структур, таким образом, может быть проинтерпретирован как последовательность подтем предметной области, к которым относятся подцепочки этой цепочки. При необходимости, эта интерпретация может быть расширена до последовательности соответствующих субъект-объектных пар, предикатных структур, или даже целых предложений, содержащих эти структуры. Последняя интерпретация является наиболее эксплицированной из всех и может быть предназначена для общения с конечным пользователем в случае необходимости представления результатов автоматического смыслового анализа текстов конечному пользователю.
Анализ фрагмента текста протекает по следующей схеме. С помощью специальных слов-маркеров выполняется фрагментация текста, затем словам приписывают из словаря все их значения. Далее на анализируемый фрагмент текста поочередно накладываются простые шаблоны, известные системе. С помощью специальных правил расширения простой образец преобразуется в полный образец путем добавления слов из текста, которые не вошли в образец. Указанная процедура осложнена тем, что может подойти не один простой образец. Используя процедуры установления семантической близости полученных образцов, формируется окончательное представление обрабатываемого текста. К недостаткам анализа следует отнести то, что анализ текста осуществляется с помощью словаря шаблонов, которые способны различать только класс событий, а не сами конкретные события. Построение дерева зависимостей необходимо осуществить с целью выявить каноническую форму класса предложений, имеющих одинаковый смысл и отличающихся порядком слов. Кроме того, в процессе построения дерева зависимостей устраняется синтаксическая омонимия. Общую схему действий можно представить в виде последовательности шагов. 1. Членение предложения по знакам пунктуации и сочинительным союзам на исходные отрезки; будем их также называть начальными сегментами. Определение вершин и типов начальных сегментов. 2. На декартовом произведении омонимов внутри начальных сегментов построение множества однозначных морфологических интерпретаций каждого сегмента. 3. Построение синтаксических групп для каждой интерпретации сегмента с помощью синтаксических правил, выявляющих синтаксические связи между словами. Оценка синтаксического покрытия каждой интерпретации. 4. Установление иерархии между сегментами с помощью синтаксических правил: вложения контактно расположенных сегментов (причастных, деепричастных оборотов, обособленного определения); определения однородности между контактно расположенными сегментами; определение отношения импликации между сегментами по подчинительным союзам, в них входящим. Синтаксические правила задают отношения между словами (сегментами) в предикативном виде.
Дата добавления: 2014-01-11; Просмотров: 1051; Нарушение авторских прав?; Мы поможем в написании вашей работы! Нам важно ваше мнение! Был ли полезен опубликованный материал? Да | Нет |