?
Система для извлечения информации из текстов на базе лексико-синтаксических шаблонов
С. 14–22.
Описывается текущее состояние программной системы с открытым кодом, разработанной и применяемой для построения различных приложений по извлечению информации из текстов на русском языке. Извлекаемая информация специфицируется в виде лексико-синтаксических шаблонов и правил языка LSPL.
В книге
Т. 1. , Смоленск: Универсум, 2016.
Грибова В. В., Шахгельдян К. И., Шалфеева Е. А. и др., В кн.: Новые информационные технологии в автоматизированных системах: материалы двадцать второго научно-технического семинара.: М.: Институт прикладной математики им. М.В. Келдыша РАН, 2019. С. 204–209.
В настоящее время медицинские организации накапливают большой объем неструктурированной информации о пациентах, для обработки которой требуются алгоритмы формализации текста. Примером такой задачи является автоматическое извлечение жалоб пациентов и их характеристик из текстов историй болезни. В данной работе предлагается алгоритм, использующий синтаксический анализ текста истории болезни, с дальнейшим уточнением семантики при помощи онтологии, содержащей описание жалоб ...
Добавлено: 30 апреля 2019 г.
Большакова Е. И., Иванов К. М., В кн.: Шестнадцатая Национальная конференция по искусственному интеллекту с международным участием КИИ-2018 (24-27 сентября 2018 г., г.Москва, Россия). Труды конференции. В 2-х томахТ. 1.: М.: РКП, 2018. С. 253–261.
Предметный указатель – список значимых терминов текстового документа с указанием страниц, на которых они употребляются. В работе описываются методы на основе лексико-синтаксических шаблонов и правил, разработанные для автоматического извлечения и отбора терминов в предметный указатель заданного научного текста, а также для выявления их подчинительных связей. ...
Добавлено: 10 декабря 2018 г.
Большакова Е. И., Иванов К. М., Тодуа А. Р., В кн.: Ломоносовские чтения: научная конференция, Москва, факультет ВМК МГУ имени М.В. Ломоносова, 17-26 апреля 2017 г.: Тезисы докладов.: М.: МГУ, МАКС Пресс, 2017. С. 123–124.
Рассматриваются новые инструментальные средства, разработанные в рамках системы извлечения информации из русскоязычных текстов по лексико-синтаксическим шаблонам, а также созданные на их базе прикладные системы. ...
Добавлено: 5 сентября 2017 г.
Большакова Е. И., В кн.: Программные системы и инструменты: тематический сборник.Т. 15.: [б.и.], 2014.
В работе рассматривается опыт использования языка лексико-синтаксических шаблонов LSPL, предназначенного для формального описания лексических и поверхностно-синтаксических свойств языковых конструкций в системах автоматической обработки текстов на русском языке. Кратко характеризуются и сравниваются выразительные возможности языка LSPL и аналогичных языков наиболее известных систем извлечения информации из русскоязычных текстов. Обсуждаются разработанные с помощью LSPL приложения, требующие анализа текстов ...
Добавлено: 26 октября 2015 г.
Большакова Е. И., Ефремова Н. Э., Шариков Г. Ф., В кн.: Новые информационные технологии в автоматизированных системах: материалы восемнадцатого научно-технического семинара.: М.: Институт прикладной математики им. М.В. Келдыша РАН, 2015.
В работе представлен краткий обзор и сравнительный анализ языковых и программных средств пяти инструментальных систем, применяемых для построения приложений для извлечения информации из текстов на русском языке: систем GATE и RCO Pattern Extractor, программного комплекса LSPL, процессора DSTL, Томита-парсера. По результатам проведенного анализа намечаются наиболее важные направления развития языка LSPL и поддерживающих его программных средств. ...
Добавлено: 26 октября 2015 г.
Соколова Е. Г., Жигалов В., Кононенко И. С. и др., В кн.: Компьютерная лингвистика и интеллектуальные технологии. Труды международного семинара "Диалог'2002"Т. 2.: М.: ГУП Академический научно-издательский, производственно-полиграфический и книгораспространительский центр РАН "Издательство "Наука", 2002.
В статье представлена программе многоцелевой автоматизированной обработки текстов Alex . Основой системы является технология иерархических шаблонов, Средствами системы Alex разработан словарь и набор лексических шаблонов, позволяющий структурировать исходную информацию. ...
Добавлено: 7 апреля 2014 г.
Brykina M. M., Толдова С. Ю., Faynveyts A. V., , in: Компьютерная лингвистика и интеллектуальные технологии: По материалам ежегодной Международной конференции «Диалог» (Бекасово, 29 мая - 2 июня 2013 г.). В 2-х т.Т. 1: Основная программа конференции. Вып. 12 (19).: М.: РГГУ, 2013. P. 163–177.
The Information Extraction task and the task of Named Entities recognition (NER) in unstructured texts in particular, are essential for modern Mass Media systems. The paper presents a case study of NER system for Russian. The system was built and tested on the Russian news texts. The method of ambiguity resolution under discussion is based ...
Добавлено: 13 февраля 2014 г.
Толдова С. Ю., Ляшевская О. Н., Вопросы языкознания 2014 № 1 С. 120–145
Статья посвящена обзору современных тематик и актуальных направлений компьютерной лингвистики на основе анализа материалов одной из конференции в этой области, а именно, 24-ой Международная конференция по компьютерной лингвистике Coling2012. В ней приводится анализ основных подходов и проблемных точек в таких традиционных областях автоматической обработки текста, как автоматический морфологический и синтаксический анализ, машинный перевод и др. ...
Добавлено: 15 октября 2013 г.
Толдова С. Ю., Брыкина М. М., Файнвейц А. В., Актуальные инновационные исследования: наука и практика 2013 № 1
Настоящая статья посвящена базовым параметрам системы извлечения из текста именованных сущностей, основанной на словарях. Компонент извлечения именованных сущностей используется во многих приложениях, в частности, весьма перспективным направлением является пополнение данных семантического веба (например, LOD-онтологий) информацией из неструктурированных источников (текстов). Основным объектом нашего внимания являются методы разрешения различной омонимии для именованных сущностей, основанные на словарях и ...
Добавлено: 15 октября 2013 г.
Хорошевский В. Ф., Информационно-измерительные и управляющие системы 2013 Т. 11 № 5 С. 25–34
В настоящей работе обсуждаются вопросы автоматизации процессов выявления новых технологических трендов по текстовым коллекциям на основе гибридного подхода, ориентированного на интеграцию классических статистических методов и методов извлечения информации из текстов на основе системы индикаторов выявления объектов, характеризующих технологические тренды. Спецификой предлагаемого подхода является и то, что по результатам статистической обработки коллекций документов происходит формирование временных ...
Добавлено: 9 августа 2013 г.
Хорошевский В. Ф., В кн.: Тринадцатая национальная конференция по искусственному интеллекту с международным участием КИИ-2012 (16-20 октября 2012 г., г. Белгород, Россия). Том 1Т. 1: Тринадцатая национальная конференция по искусственному интеллекту с международным участием КИИ-2012 (16-20 октября 2012 г., г. Белгород, Россия).: Белгород: Российская ассоциация искусственного интеллекта, 2012. С. 252–258.
В докладе обсуждаются вопросы автоматизации процессов выявления новых технологических трендов на основе обработки документов разных жанров. Представлен гибридный подход к выявлению новых технологических трендов, где для повышения качества результатов используются методы и средства статистической обработки коллекций документов, интегрированные с методами извлечения информации из текстов. ...
Добавлено: 15 января 2013 г.