• Main Navigation
  • Main Content
  • Sidebar

Электронные библиотеки

  • Главная
  • О нас
    • О журнале
    • Цели и задачи
    • Тематика
    • Главный редактор
    • Редакция
    • Отправка материалов
    • Заявление об открытом доступе
    • Заявление о конфиденциальности
    • Контакты
  • Текущий выпуск
  • Архивы
  • Регистрация
  • Вход
  • Поиск
Издается с 1998 года
ISSN 1562-5419
16+
Language
  • Русский
  • English

Найти

Расширенные фильтры

Результаты поиска

Интеграционные возможности Системы управления электронными библиотеками LibMeta

А.А. Каленкова, В.А. Серебряков
Аннотация: В статье представлена Система управления электронными библиотеками (СУЭБ) LibMeta, предназначенная для интеграции библиотечной и музейной информации. Приводится схема метаданных СУЭБ LibMeta, построенная на базе схемы ЕНИП, она включает основной и библиотечный профили, а также профили для работы с музейными и медиа-объектами. Интеграция метаданных из различных источников может привести к дублированию информации: дается подробный алгоритм интеграции метаданных, который позволяет избежать дублирования мета-описаний.
Ключевые слова: цифровые библиотеки, метаданные, интеграция данных.

Формирование структурированных представлений научных журналов для интеграции в граф знаний и семантического поиска

Ольга Муратовна Атаева, Михаил Геннадьевич Кобук
1306-1323
Аннотация:

Работа посвящена проблеме развития библиотеки научных предметных областей SciLibRu, как продолжения семантического описания научных трудов проекта LibMeta. В основе этой библиотеки лежит концептуальная модель данных, структура и семантика которой сформированы на принципах онтологического моделирования. Такой подход обеспечивает строгое описание предметной области, формализацию взаимосвязей между сущностями и возможность дальнейшего автоматизированного анализа данных. Целью настоящего исследования были разработка и экспериментальное применение методов структуризации содержимого научных журналов в формате LaTeX для их интеграции в онтологию библиотеки и обеспечения семантического поиска.


Предложен алгоритм трансляции в формат XML данных, представленных множеством файлов, для интеграции в онтологию библиотеки. Реализован модуль векторного поиска, основанный на вычислении эмбеддингов с использованием языковых моделей. Выявлены закономерности распределения эмбеддингов и факторы, влияющие на точность ранжирования результатов поиска. Проведено тестирование двух названых компонентов.


Разработанный метод составляет основу для автоматического включения содержимого научных журналов в граф знаний SciLibRu и создания обучающих корпусов для языковых моделей, ограниченных рамками научных предметных областей. Полученные результаты способствуют развитию систем навигации по графу знаний журналов, а также рекомендательных механизмов и инструментов интеллектуального поиска по русскоязычным научным текстам.

Ключевые слова: полуструктурированные данные, онтология текста, LaTeX, векторное представление текста, полнотекстовый поиск, семантический поиск.

Русско-английский набор данных и выравнивание сущностей в графах знаний с несопоставимыми сущностями

Зинаида Владимировна Апанович, Даниил Георгиевич Керного
332-352
Аннотация:

В последние годы кратно возрос интерес к графам знаний (ГЗ) как в научном, так и в промышленном сообществах. Интеграция различных графов знаний является одной из актуальнейших задач и используется, например, для разработки сложных цифровых двойников промышленных систем. Интеграция графов знаний также необходима при объединении графов знаний, извлеченных из текстов на естественном языке при помощи больших языковых моделей. Одной из компонент решения задачи интеграции ГЗ является задача выравнивания сущностей, пытающаяся идентифицировать в разных ГЗ сущности, описывающие один и тот же объект реального мира. К сожалению, в реальных графах знаний многие сущности не имеют эквивалентов в других графах знаний. В частности, каждый фрагмент графа знаний, извлеченный из отдельной публикации, может иметь свою собственную структуру имен сущностей и идентификаторов, что существенно усложняет задачу идентификации сущностей. В работе описаны эксперименты по выравниванию сущностей при наличии несопоставимых сущностей на примере русско-английского набора данных

Ключевые слова: графы знаний, выравнивание сущностей, несопоставимые сущности, двусторонний поиск ближайшего соседа с порогом.

Использование гетерогенной пространственной информации при решении задач устойчивого развития территорий

Е.Б. Кудашев, С.Ю. Марков, М.А. Попов
Аннотация: Статья посвящена проблемам интегрирования гетерогенных геопространственных данных при решении задач устойчивого развития территорий. Предложены концептуальные подходы к построению электронной инфраструктуры доступа к гетерогенной пространственной информации, проанализированы основные проблемы интегрирования разнородных данных, разработана модель интегрирования геопространственных данных на основе архитектуры SOA.
Ключевые слова: геопространственные данные, гетерогенность, метаданные, инфраструктура, интегрирование данных.

Платформа ZooSPACE - организация доступа к разнородным распределенным ресурсам

О.Л. Жижимов, А.М. Федотов, Ю.И. Шокин
Аннотация: Рассматривается технологическая платформа массовой интеграции распределённых гетерогенных источников данных. В основе технологической платформы находится программный комплекс с условным названием ZooSPACE, разрабатываемый в ИВТ СО РАН. Комплекс ZooSPACE строится на основе нескольких слабосвязанных распределенных подсистем, обеспечивающих конфигурирование (ZooSPACE-L), доступ к ресурсам (ZooSPACE-Z), пользовательские и административные WEB-интерфейсы (ZooSPACE-W), сбор статистики (ZooSPACE-S) и мониторинг (ZooSPACE-M) всей системы. Обсуждается архитектура и состав каждой из подсистем. Описывается экспериментальный стенд, созданный для проведения экспериментальных исследований компонентов технологической платформы интеграции разнородных распределенных ресурсов ZooSPACE.
Ключевые слова: распределенные информационные системы, интеграция гетерогенных данных, управление доступом к информационным ресурсам, Z39.

Методико-математические основы логико-понятийной компетенции в деятельности современного учителя математики

Василий Иванович Горбачев
331-340
Аннотация: Наряду с общепредметными, в содержании логико-понятийной компетенции выделены и методико-математические основы ее становления. В предметно-математическом плане в качестве базовой представлена методико-математическая адаптация психолого-дидактических закономерностей становления системы субъектного предметного знания. Ее дополняют специфические методико-математические закономерности: становления абстрактного математического мышления и его компонентов; структурного формирования пространственного и теоретико-пространственного типов мышления; анализа системы математического знания в содержании учебной математической теории; интеграции математического языка, математической речи и математического мышления; понятийно-категориальной интеграции учебных математических теорий.
Ключевые слова: предметные компетенции учебной математической деятельности, содержание логико-понятийной компетенции, методико-математические основы.

Интеграция гетерогенной пространственной информации для решения задач поиска нефти и газа

М.А. Попов, С.А. Станкевич, С.Ю. Марков, А.В. Зайцев, Е.Б. Кудашев
Аннотация: Статья посвящена проблемам совместного использования гетерогенной геопространственной информации при решении задач поиска нефти и газа. Рассмотрена модель интеграции аэрокосмической информации и данных наземных спектральных измерений, предложен подход к интегрированию данных с использованием программного продукта FME, приведены результаты экспериментальных исследований.
Ключевые слова: гетерогенная геопространственная информация, аэрокосмическая информация, наземные спектральные измерения, программный продукт FME.

Библиотека научных предметных областей SciLibRu

Ольга Муратовна Атаева, Наталия Павловна Тучкова, Кирилл Борисович Теймуразов, Айдин Абдышов, Михаил Геннадьевич Кобук
1324-1345
Аннотация:

Работа посвящена проблеме интеграции данных для представления научных предметных областей на основе их семантического описания в цифровой библиотеке SciLibRu. В качестве модели данных использованы онтология и граф знаний библиотеки LibMeta. Наполнение библиотеки SciLibRu осуществляется путем добавления данных научных журналов. Показано, как реализованы этапы анализа слабоструктурированных научных публикаций для их встраивания в онтологию библиотеки. При прохождении всех этапов предобработки данных формируется датасет, который может быть использован в обучении языковых моделей для запросов в русскоязычных научных предметных областях.


Приложение работы заключается в создании рекомендательных систем для работы с научными русскоязычными журналами.

Ключевые слова: икладная онтология, граф знаний, источники данных, анализ слабоструктурированных научных публикаций.

Третий Всероссийский Симпозиум «Инфраструктура научных информационных ресурсов и систем»

Е.Б. Кудашев, В.А. Серебряков
Аннотация: Статья посвящена анализу работы Третьего Всероссийского Симпозиума «Инфраструктура научных информационных ресурсов и систем», состоявшегося в г. Сухум, Абхазия, 5-8 октября 2013 г. Лавинообразный рост объема электронного контента потребовал разработки новых подходов к хранению и непрерывному доступу к цифровым научным данных. Особый интерес вызывают актуальные научные задачи по созданию инфраструктур пространственных данных. На Симпозиуме традиционно обсуждаются вопросы, связанные с интеграцией геоинформационных ресурсов и свободного доступа к ним, исследования e-Infrastructures с целью формирования распределенных научных информационных ресурсов, развития взаимосвязанных каталогов и создания сети интегрированных интероперабельных баз данных. Развитие e-Science Infrastructures должно стать основой формирующихся систем коллективной работы исследователей на основе виртуального объединения информационных и вычислительных ресурсов. Основным направлением работы Третьего Симпозимума были вопросы применения современных подходов в технологии развития информационных систем к задачам информационной поддержки научных исследований.
Ключевые слова: цифровой контент, научные данные, формирование цифровой инфраструктуры, непрерывный доступ и длительное хранение данных, третий Симпозиум.

Интеграция данных по свойствам веществ и материалов на основе онтологического моделирования предметной области

А.О. Еркимбаев, В.Ю. Зицерман, Г.А. Кобзев, В.А. Серебряков, Л.Н. Шиолашвили
Аннотация: Изучена специфика предметной области "Свойства веществ и материалов", рассматриваемой как "полигон" при отработке подходов к интеграции научных Баз данных. На конкретных примерах показаны возможности онтологического моделирования для интеграции численных данных по свойствам на семантическом уровне. Предложена общая схема онтологии для представления термодинамических свойств данных по свойствам чистых соединений.
Ключевые слова: онтологическое моделирование, формализация предметной области, интеграция численных данных, термодинамические свойства вещества.

Цифровая инфраструктура электронного научного журнала: автоматизация редакционно-издательских процессов и система сервисов

Миляуша Салахутдиновна Галявиева, Александр Михайлович Елизаров, Евгений Константинович Липачёв
408-465
Аннотация:

Описаны современные модели и средства публикации и распространения научных знаний. Охарактеризованы современные информационные системы управления научными изданиями и сервисы, определяющие их функциональность.

Введено понятие цифровой инфраструктуры электронного научного журнала как комплекса, который объединяет программную платформу, реализующую основные рабочие процессы управления электронным журналом, и информационные системы, которые обеспечивают функционирование как основных, так и дополнительных сервисов, учитывающих, в частности, специфику предметной области журнала.

Представлен подход к организации цифровой инфраструктуры электронного научного журнала на основе открытой программной системы Open Journal Systems (OJS). Предложены сервисы, расширяющие функциональные возможности этой системы и учитывающие специфику предметной области научных журналов. На основе технологии расширения функционала OJS созданы программные модули, обеспечивающие автоматизацию ряда редакционных процессов электронного научного журнала.

Представлена система сервисов автоматической обработки коллекций научных документов. Эти сервисы обеспечивают проверку соответствия документов коллекций принятым правилам формирования коллекций и преобразования документов в установленные форматы; структурный анализ документов и извлечение метаданных, а также их интеграцию в научное информационное пространство. Система сервисов позволяет автоматически выполнять набор операций, который не реализуем за практически приемлемое время при традиционной «ручной» обработке электронного контента, и предназначена для обработки больших коллекций научных документов.

Охарактеризованы алгоритмы автоматической стилевой валидации текстов на этапе регистрации статьи в информационной системе электронного научного журнала, автоматического подбора рецензентов, рассылки уведомлений и контроля сроков рецензирования.

Представлены методы обработки документов, содержащих математические формулы, в частности, алгоритм поиска по формулам в коллекциях математических документов. Указаны основные идеи, подходы и уже полученные результаты по разработке семантических технологий управления математическими знаниями, в том числе, подход к построению рекомендательных систем на основе онтологий математического знания и метод автоматизации процесса первичной обработки научной статьи, использующей TеX-нотацию.

Охарактеризована проблема построения системы анализа и оценки информационного и социального воздействия публикуемого научного контента на его пользователей. Проведено сопоставление традиционных (библиометрических и наукометрических) и альтернативных показателей такой оценки. Описан мировой опыт использования информетрических сервисов на сайтах научных журналов. Обсуждены варианты реализации этих подходов в рамках цифровой инфраструктуры электронного научного журнала.

Ключевые слова: издательские системы, современные модели публикации и распространения научных знаний, информационное общество, электронный научный журнал, информационные системы управления научными изданиями и публикациями, интеграция электронных ресурсов.

Цифровая платформа для интеграции и анализа данных геофизического мониторинга байкальской природной территории

Андрей Павлович Григорюк, Людмила Петровна Брагинская, Игорь Константинович Семинский, Константин Жанович Семинский, Валерий Викторович Ковалевский
303-316
Аннотация:

Представлена цифровая платформа для данных комплексного мониторинга опасных геодинамических, инженерно-геологических и гидрогеологических процессов, протекающих в регионе интенсивного природопользования центральной экологической зоны Байкальской природной территории (ЦЭЗ БПТ). Платформа предназначена для интеграции и анализа данных, поступающих с нескольких полигонов, расположенных в пределах ЦЭЗ БПТ, с целью оценки состояния геологической среды и прогнозирования проявлений опасных процессов. Платформа построена по клиент-серверной архитектуре. Хранение, обработка и анализ данных осуществляются на сервере, к которому пользователи могут обращаться через интернет посредством веб-браузера. Блочная структура сервера позволяет легко расширять набор процедур обработки и анализа данных, а также визуализации результатов. В настоящее время доступны несколько методов фильтрации данных (линейная частотная, Савицкого–Голея и другие), различные методы спектрального и вэйвлет-анализа, мультифрактальный и энтропийный анализ, анализ пространственных данных. Цифровая платформа была опробована на реальных данных.

Ключевые слова: геофизический мониторинг, цифровая платформа, предвестники, сейсмический прогноз, землетрясения.

Онтологический подход к проектированию микросервисной архитектуры

Евгений Александрович Малых, Андрей Алексеевич Блощук, Ольга Муратовна Атаева
822-841
Аннотация:

Несмотря на широкое использование микросервисной архитектуры в разработке программных систем, в настоящее время не существует формализованного подхода, обеспечивающего согласованное и гарантированное взаимодействие микросервисов на уровне передаваемых данных, что приводит к возникновению интеграционных ошибок и усложняет сопровождение распределенных систем. В работе предложен подход к организации взаимодействия микросервисов на основе онтологического моделирования, обеспечивающего формализацию структур данных и автоматизированную валидацию сообщений. Предложен метод преобразования в онтологических моделей формальных описаний схем данных основанный на спецификации схем GraphQL. Он позволяет автоматизировать процесс валидации данных и снизить количество интеграционных ошибок. Разработана также онтологическая модель, обеспечивающая анализ зависимостей между микросервисами и механизм валидации контрактов сообщений.


Практическая значимость работы заключается в достижении согласованного описания микросервисов, операций и форматов сообщений в результате использования онтологического подхода. Представление онтологии в виде графа позволяет анализировать зависимости между микросервисами и упрощает сопровождение крупных распределенных систем.

Ключевые слова: онтология, GraphQL Schema, интеграция данных, микросервисная архитектура, потоки сообщений, валидация данных, межсервисное взаимодействие, онтологическая модель, согласованность данных, управление схемами, шина данных.

Технологии семантического веба для поддержки фундаментальных исследований в геологии

Игорь Вячеславович Бычков, Евгений Александрович Черкашин, Цзинь Чжан, Татьяна Юрьевна Черкашина, Виктория Алексеевна Попова, Оксана Анатольевна Мазаева, Оксана Викторовна Лунина
740-780
Аннотация:

Представлена инновационная методология применения технологий семантического веба для поддержки фундаментальных геологических исследований. Рассмотрена проблема семантической интеграции разнородных геологических данных, характеризующихся масштабом разного уровня и междисциплинарностью. Разработана пятиэтапная методология, включающая анализ предметной области, онтологическое концептуальное моделирование, трансформацию данных в граф знаний, развертывание инфраструктуры распределенного доступа к данным на основе концептуальной модели, а также интеграцию с процедурами обработки и анализа. Практическая апробация проведена на трех кейсах: анализе геохимических данных для оценки уровня загрязнения территории, создании информационной системы о разломах и исследовании динамики береговой зоны водохранилищ. Предложенный онтологический подход обеспечивает соответствие FAIR-принципам и преодоление «семантического барьера» в геологических исследованиях. Показано, что технологии семантического веба позволяют перейти от фрагментированных информационных массивов к целостному семантическому пространству геологических знаний, что открывает новые возможности для генерации комплексных научных гипотез и кросс-дисциплинарных исследований.

Ключевые слова: семантический веб, графы знаний, онтологическое моделирование, семантическое пространство научных знаний, фундаментальные геологические исследования.

Интеграция данных о морской среде и деятельности

Е.Д. Вязилов, Н.Н. Михайлов
Аннотация: Рассмотрено состояние интеграции данных о морской среде и деятельности. Представлены перспективы развития Единой государственной системы информации об обстановке в Мировом океане.
Ключевые слова: интеграция данных, морская среда, морская деятельность, ЕСИМО, информационное обслуживание.

Интеграция географических информационных ресурсов и обеспечение онлайн-доступа к ним для решения научных и образовательных задач

И.К. Лурье, А.Р. Аляутдинов, С.А. Осокин
Аннотация: Рассматривается проблема интеграции геоинформационных ресурсов и свободного доступа к ним путем методов и технологий создания специализированных инфраструктур пространственных данных, геопорталов, баз данных коллективного пользования и веб-ГИС.
Ключевые слова: геоинформационные ресурсы, пространственные данные, геопорталы, базы данных, веб-ГИС.

Рекомендательная система поиска семантически близких фрагментов программного кода

Виталий Иванович Зорин, Евгений Константинович Липачев
751-781
Аннотация:

Рекомендательные системы в научном информационном пространстве являются инструментом поиска и навигации при работе с научными документами. Программный код в настоящее время рассматривается как объект научного знания, и, как следствие, важной задачей является создание систем поддержки жизненного цикла программ, в частности поиска близких программных решений, обнаружения заимствований программного кода, анализа и оценки качества кода. В работе предложена рекомендательная система, формирующая для пользователя персонализированный список фрагментов кода, функционально эквивалентных входному коду-запросу, представленному на одном из языков программирования из установленного набора. Базовый алгоритм системы основан на представлении программного кода в виде абстрактного синтаксического дерева с последующим построением векторного пространства программных кодов. Семантическое сходство программных кодов определяется по расстоянию между векторами кодов в многомерном пространстве. Персонализация выдачи достигается за счет модуля фильтрации, который ранжирует найденные фрагменты с учетом профиля пользователя. Рассматриваемыми факторами являются языковые предпочтения пользователя и его области научных интересов, извлекаемые посредством интеграции с ORCID. Для обеспечения работы системы на основе корпуса CodeNet создан специализированный набор фрагментов программного кода. Решена также задача автоматического определения языка программирования по фрагменту представленного кода на одном из языков, входящих в текущий рейтинговый список языков программирования.

Ключевые слова: абстрактное синтаксическое дерево, векторизация кода, контентная фильтрация, кросс языковой поиск, межъязыковой программный клон, рекомендательная система, сходство программного кода.

Новая роль библиотеки как создателя и администратора образовательного портала университета

Елена Юрьевна Лотова, Людмила Вячеславовна Апакина
426-434
Аннотация: Подняты вопросы преодоления кризиса в библиотечной сфере и решение этого вопроса путем объединения информационных библиотечных ресурсов и учебно-образовательной платформы Российского университета дружбы народов (РУДН). Рассмотрена новая роль библиотеки университета в создании и поддержке электронной образовательной среды, решении вопроса интеграции ЭБС РУДН и других информационных ресурсов с системой управления обучением.
Ключевые слова: новая роль библиотеки, LMS, ЭБС, интеграция информационных ресурсов с учебно-образовательной платформой, библиопоиск.

Цифровой помощник геолога-исследователя

Виталий Сергеевич Еременко, Вера Викторовна Наумова
781-787
Аннотация:

Представлены концепция и архитектура мультиагентной системы, предназначенной для функционирования в роли цифрового ассистента геолога-исследователя. Система нацелена на автоматизацию ключевых этапов научного исследования: от формулировки темы и анализа литературы до выдвижения гипотез и оформления результатов. Описана интеграция системы с платформой GeologyScience.ru, обеспечивающей доступ к разнородным геологическим данным и инструментам анализа, а также подходы к адаптации больших языковых моделей (LLM) для решения специализированных научных задач.

Ключевые слова: цифровой помощник геолога-исследователя, мультиагентная система, искусственный интеллект, LLM.

Развитие цифровой е-Инфраструктуры непрерывного доступа к научным ресурсам: формирование банка спектральных данных ДЗЗ

М.А. Попов, Е.Б. Кудашев, С.П. Ковальчук, С.А. Пикулик, С.А. Станкевич, С.Ю. Марков
Аннотация: При изучении природных и искусственных объектов с помощью спутниковых технологий важную роль играют спектральные данные, которые несут информацию о распределении отражающих/излучающих свойств физических объектов и материалов по длинам волн. Необходимо отметить, что оперативное получение необходимых спектральных данных из названных выше источников обычно является проблемой. В работе описан подход к построению банка спектральных данных с расширенными функциональными возможностями, позволяющими реализовывать не только справочно-поисковые процедуры, но и достаточно широкий круг расчетно-прикладных процедур относительно спектральных данных и их атрибутов. На основе системного анализа предметной области и реляционной модели предложена схема БД, реализованная средствами MS Access. Обоснована организационная структура БСД. Предложена простая схема интеграции БСД в е-Инфраструктуру непрерывного доступа к научным ресурсам ДЗЗ.
Ключевые слова: электронные библиотеки, спутниковые технологии, спектральные данные, цифровая инфраструктура непрерывного доступа, дистанционное зондирование Земли.

Формирование метаданных для международных баз цитирования в системе управления электронными научными журналами

Алексей Николаевич Герасимов, Александр Михайлович Елизаров, Евгений Константинович Липачев
6-31
Аннотация:

Предложен алгоритм автоматического извлечения библиографических данных из однородного массива публикаций (в частности, выпусков научного журнала) и формирования блоков метаданных для экспорта в международные информационно-аналитические системы. Развиты методы интеграции платформы управления электронными научными журналами Open Journal Systems и международных баз научного цитирования.

Ключевые слова: издательские системы, электронный научный журнал, интеграция электронных ресурсов, базы данных научного цитирования, экстракция метаданных.

Разработка адаптивной системы генерации игровых квестов и диалогов на основе больших языковых моделей

Всеволод Тарасович Трофимчук, Влада Владимировна Кугуракова
953-993
Аннотация:

Рассмотрена проблема создания динамических нарративных систем для видеоигр с интерактивностью в реальном времени. Представлены разработка и тестирование компонента интеграции GPT для генерации диалогов, выявившие критическое ограничение облачных решений – задержку в 30 с., неприемлемую для игрового процесса. Предложена гибридная архитектура адаптивной системы, сочетающая LLM с механизмами обучения с подкреплением. Особое внимание уделяется решению проблем консистентности игрового мира и управлению долгосрочным контекстом взаимодействий с NPC через RAG-подход. Обоснован переход к парадигме Edge AI с применением методов квантования для достижения целевой задержки 200–500 мс. Разработаны метрики оценки персонализации и динамической адаптации контента.

Ключевые слова: видеоигры, большие языковые модели, LLM, генерация диалогов, диалогогенерация, генерация квестов, квестогенерация, адаптивные квесты, процедурная генерация контента, агентное поведение, игровой искусственный интеллект, машинное обучение в играх.

Электронные архивы длительного срока жизни: модернизация и интеграция

Александр Гурьевич Марчук, Сергей Николаевич Трошков, Ирина Александровна Крайнева
1137-1156
Аннотация:

За период около двадцати лет в Институте систем информатики им. А.П. Ершова Сибирского отделения РАН (ИСИ СО РАН) были созданы информационные системы исторической направленности: Электронный архив академика А.П. Ершова, Фотоархив Сибирского отделения РАН, Архив газеты «Наука в Сибири», Открытый архив СО РАН и др. У каждого из этих ресурсов есть своя специфика, но в целом их контент базируется на общей социальной и территориальной основе научной и общественной деятельности СО АН СССР/РАН и Новосибирского Академгородка. В статье рассмотрены некоторые проблемы интеграции/дезинтеграции разрозненных электронных ресурсов на общую платформу на базе имеющихся и создаваемых инструментов.

Ключевые слова: интеграция электронных ресурсов, качественная информация, открытые архивы, междисциплинарность, история науки, Сибирское отделение РАН, проприетарное ПО, Semantic Web, Drupal.

К вопросу о представлении синтагматических отношений морфем в векторных языковых моделях

Дарья Кирилловна Родионова, Ольга Александровна Митрофанова
898-918
Аннотация:

В работе рассмотрено представление семантической структуры производных слов в языковых моделях, учитывающее внутрисловные синтагматические отношения между словообразовательными морфемами. Эксперименты проводились с привлечением морфемных моделей НейроКРЯ, а также моделей fastText и ruRoBERTa. Проверена гипотеза о композициональности производных слов, представляемых в виде агрегированных векторов морфем, а также выполнено сравнение представлений семантических отношений с помощью морфемных векторов fastText и стандартных векторов подслов в модели ruRoBERTa. Полученные результаты указывают на умеренную чувствительность векторов fastText к синтагматическим связям между морфемами и словообразовательным типам. Установлено также что агрегация морфемных векторов в fastText улучшает регистрацию семантических отношений между словами, связанными словообразовательными отношениями, по сравнению с агрегацией векторов подслов в модели ruRoBERTa.


Стандартные токенизаторы BPE (Byte-Pair Encoding) и WordPiece, применяемые в моделях семейства Transformer, являются слабоинтерпретируемыми в отношении языковых данных, поскольку в них сегменты слов не всегда соответствуют морфемам. Исследовательская проблема состоит в необходимости оценки того, в какой мере современные языковые модели способны регистрировать лингвистические признаки, характеризующие отношения производных слов в словообразовательных гнездах.


В работе оценена способность предсказывающих моделей распределенных векторных вложений воспроизводить синтагматические связи между морфемами внутри производных слов и на уровне словообразовательных гнезд в русском языке.


Полученные результаты стимулируют разработку нейросетевых архитектур, учитывающих синтагматические отношения между морфемами, совершенствование морфемных токенизаторов и их интеграцию в языковые модели.

Ключевые слова: языковая модель, морфемный анализ, словообразовательные способы, композициональность.

Электронные библиотеки в Вычислительном центре Российской академии наук – основные разработки

Владимир Алексеевич Серебряков
534-566
Аннотация: Рассмотрены основные проекты, которые были реализованы в Вычислительном центре им. А.А. Дородницына Российской академии наук (ВЦ РАН) за последние 20 лет, т. е. с 1998 года. Одним из первых был реализован пилотный проект «Интегрированной системы информационных ресурсов (ИСИР) РАН». Успешное завершение этого проекта позволило развернуть работы по интеграции разнородных научных информационных ресурсов в общеакадемическую научную информационную систему. Важным этапом был проект создания Единого Научного Информационного Пространства (ЕНИП) РАН. Этот проект основывался на подсистеме «Научный институт РАН», созданной в ВЦ РАН и Центре научных телекоммуникаций (ЦНТК) РАН. Учитывая важность формирования цифровых библиотек, Российская академия наук приняла в 2006 году целевую научную программу «Создание ЦБ «Научное наследие России»», в соответствии с которой была реализована цифровая библиотека. Созданный портал «ГеоМета» – это стандартизированная и децентрализованная среда управления пространственной информацией, разработанная для доступа к базам геоданных, картографическим продуктам и связанным с ними метаданным из различных источников, облегчающая обмен пространственной информацией между организациями и ее совместное использование посредством интернета. В настоящее время основное направление работ – цифровая персональная семантическая библиотека LibMena. Основная задача этой системы заключается в предоставлении пользователю унифицированного представления для возможности автоматизированного извлечения интересующей его информации по определенной предметной области.
Ключевые слова: предметная область, научная предметная область, научная информация, научные знания, обобщенное представление научной предметной области, таксономии, тезаурусы, глобальные онтологии, поисковые системы, организация научных знаний, цифровые библиотеки.
1 - 25 из 57 результатов 1 2 3 > >> 
Информация
  • Для читателей
  • Для авторов
  • Для библиотек
Отправить материал
Текущий выпуск
  • Логотип Atom
  • Логотип RSS2
  • Логотип RSS1

Электронные библиотеки

ISSN 1562-5419

Информация

  • О журнале
  • Цели и задачи
  • Тематика
  • Руководство для авторов
  • Отправка материалов
  • Заявление о конфиденциальности
  • Контакты
  • eLIBRARY.RU
  • dblp computer science bibliography

Отправить статью

Авторам нужно зарегистрироваться в журнале перед отправкой материалов, или, если вы уже зарегистрированы, можно просто войти со своей учетной записью и начать процесс отправки, состоящий из пяти шагов.

Отправить материал
Больше информации об этой издательской системе, платформе и рабочем процессе от OJS/PKP.

© 2015-2026 Казанский (Приволжский) федеральный университет; Институт развития информационного общества