• Main Navigation
  • Main Content
  • Sidebar

Электронные библиотеки

  • Главная
  • О нас
    • О журнале
    • Цели и задачи
    • Тематика
    • Главный редактор
    • Редакция
    • Отправка материалов
    • Заявление об открытом доступе
    • Заявление о конфиденциальности
    • Контакты
  • Текущий выпуск
  • Архивы
  • Регистрация
  • Вход
  • Поиск
Издается с 1998 года
ISSN 1562-5419
16+
Language
  • Русский
  • English

Найти

Расширенные фильтры

Результаты поиска

Цифровая экосистема OntoMath как подход к построению пространства математических знаний

Александр Михайлович Елизаров, Александр Витальевич Кириллович, Евгений Константинович Липачёв, Ольга Авенировна Невзорова
154-202
Аннотация:

Представлены результаты по созданию методов управления математическим знанием в контексте цифровых математических библиотек. Программные инструменты, разработанные на основе этих методов, являются частью цифровой экосистемы OntoMath, в рамках которой осуществляется их взаимодействие. Приведено краткое описание архитектуры экосистемы OntoMath, выделены уровни предметных онтологий и внешних онтологий, а также уровень программных инструментов и сервисов. В отдельную категорию выделены семантические сервисы. Этим термином обозначены программные инструменты, в функционале которых используются запросы к предметным онтологиям для обеспечения управления объектами знаний. Даны общие описания разрабатываемых предметных онтологий: образовательной математической онтологии OntoMathEdu и онтологии профессиональной математики OntoMathPRO. Отражено развитие образовательной онтологии в направлении включения образовательных пререквизитных связей между классами. Среди программных инструментов цифровой экосистемы выделены сервисы поиска по математическим электронным коллекциям, сервис семантического аннотирования математических документов, инструменты семантической разметки образовательных математических документов, а также система автоматической генерации проверочных тестов по математическим образовательным дисциплинам.


В рамках цифровой экосистемы OntoMath развиваются рекомендательные системы специального назначения. В текущей версии экосистемы представлены рекомендательная система формирования списка близких статей, основанная на онтологии OntoMathPRO, рекомендательная система назначения экспертов для поддержки процесса научного рецензирования и рекомендательные системы подбора предметных классификаторов УДК и кодов Mathematics Subject Classification для математических документов. Приведены также результаты, полученные в направлении создания фабрики метаданных цифровой библиотеки, включающей сервисы и инструменты извлечения, уточнения, пополнения и нормализации метаданных документов электронных математических коллекций. Отметим, что экосистема OntoMath разрабатывается как технологическая основа цифровой математической библиотеки Lobachevskii-DML.

Ключевые слова: цифровая экосистема, экосистема OntoMath, цифровая математическая библиотека, Lobachevskii-DML, онтология, математическая онтология OntoMathPRO, образовательная онтология OntoMathEdu.

Использование методов тематического анализа в наукометрических системах

Александр Сергеевич Козицын, Сергей Александрович Афонин, Дмитрий Алексеевич Шачнев
315-338
Аннотация:

Во многих современных наукометрических системах и системах цитирования представлены различные механизмы тематического поиска и тематической фильтрации информации. В большинстве случаев для тематического анализа статей и журналов используется полнотекстовый подход, который имеет ряд ограничений. Использование алгоритмов, основанных на анализе графов как автономно, так и совместно с полнотекстовыми алгоритмами, позволяет устранить эти ограничения и улучшить полноту и точность тематического поиска. Алгоритм, разработанный авторами и представленный в этой работе, использует для анализа тематической близости журналов граф соавторства. Алгоритм нечувствителен к языку журнала и подбирает похожие журналы на разных языках, что сложно реализуемо для алгоритмов, основанных на анализе полнотекстовой информации. Апробация алгоритма проводилась в наукометрической системе ИАС ИСТИНА. В интерфейсе, разработанном для этих целей, пользователь может выбрать один близкий ему по тематике журнал, и система автоматически сформирует подборку журналов, которые могут представлять интерес для пользователя как с точки зрения изучения имеющихся в них материалов, так и с точки зрения публикации собственных статей. В перспективе разработанный алгоритм можно адаптировать для поиска похожих по тематике конференций, сборников публикаций и научных проектов. Наличие такого инструмента увеличит публикационную активность молодых сотрудников, повысит цитируемость статей и цитируемость между журналами. Результаты работы алгоритма определения тематической близости между журналами, сборниками, конференциями и научными проектами также могут использоваться для построения правил в моделях разграничения доступа к данным на основе онтологий предметной области.

Ключевые слова: тематическая классификация, библиографические данные, граф соавторства, информационные системы.

Система тестирования контроллеров, основанная на распознавании текста на экране

Александр Александрович Докукин
1368-1384
Аннотация:

Описано решение задачи тестирования контроллеров на основе чтения информации с их экрана. Для этого разработана программно-аппаратная система, состоящая из камеры и программных модулей, реализующих необходимые алгоритмы и методы: модуля предобработки изображения; модуля определения типа меню; модуля обработки символов шрифта; модуль чтения текста, в том числе, написанного различными шрифтами; собственно модуля тестирования. Система реализована для контроллеров определенного типа с монохромным дисплеем 128 х 64 точек. Все методы реализованы на языке Python с использованием популярных библиотек. Система внедрена в эксплуатацию и на данный момент осуществляет автоматизацию нескольких наиболее трудоемких тестов. Поддерживается расширение их набора в виде плагинов.

Ключевые слова: компьютерное зрение, распознавание текста, тестирование контроллеров.

Извлечение аспектов товаров или услуг из отзывов потребителей с использованием модели условных случайных полей

Юлия Владимировна Рубцова, Сергей Андреевич Кошельников
203-221
Аннотация: Описана система, принимавшая участие в соревновании SentiRuEval-2015 по автоматическому извлечению аспектов из отзывов и оценке этих аспектов по тональности. В основе разработанной системы лежит алгоритм условных случайных полей (CRF), она использовалась в решении двух подзадач и тестировалась на двух предметных областях: рестораны и автомобили. Для обеих задач и обеих предметных областей показаны высокие показатели метрики полноты. Это означает, что система может вполне успешно находить аспектные термины. Вместе с тем, полученный низкий показатель точности свидетельствует о том, что система принимает за аспектные достаточно много терминов, которые аспектными не являются. В целом же система показала сравнительно хорошие результаты по сравнению с другими участниками соревнования.
Ключевые слова: извлечение знаний, извлечение аспектов, CRF.

Рекомендательная система поиска экспертов для проведения научного рецензирования в математическом журнале

708-732
Аннотация: Предложен подход к организации экспертной оценки научного документа, представленного для публикации в математический журнал. Ограничение предметной области связано с использованием системы математической классификации Mathematical Sciences Classification System – MSC. Представлена рекомендательная система, позволяющая сформировать список возможных экспертов для проведения процедуры научного рецензирования математической статьи. Эта рекомендательная система использует коды MSC2020, изначально представленные автором статьи. Если в статье указаны коды MSC2000 или MSC2010, производится их автоматическое преобразование в коды MSC2020. Для каждого эксперта в системе поддерживается персональный профиль, который содержит набор кодов MSC2020, дополненный числовыми характеристиками, – весами, вычисленными для каждого кода в соответствии с системой учета компетенций, предпочтений или отказов от участия в процедуре рецензирования, сформированных в процессе предыдущей работы в качестве эксперта. Этот набор автоматически редактируется в случае включения эксперта в список возможных рецензентов – повышаются или уменьшаются веса нескольких кодов, а также добавляются новые коды. Рекомендательная система реализована в виде встроенного инструмента (плагина) платформы Open Journal Systems (OJS). Разработанный метод апробирован в информационной системе научного журнала Lobachevskii Journal of Mathematics (https://ljm.kpfu.ru).
Ключевые слова: информационная система научного журнала, Open Journal Systems, рабочий процесс рецензирования, автоматический выбор рецензентов, Mathematics Subject Classification 2010, Lobachevskii Journal of Mathematics.

Информационная система регистрации результатов интеллектуальной деятельности сотрудников научного учреждения

Светлана Александровна Власова, Николай Евгеньевич Калёнов
218-237
Аннотация:

Представлена разработанная авторами объектно-ориентированная веб-система, предназначенная для формирования метаданных, описывающих результаты научной деятельности сотрудников учреждения (группы учреждений), и предоставления различных справочно-статистических данных о публикациях и докладах, сделанных ими на научных конференциях, симпозиумах, семинарах. Система ориентирована на работу с объектами таких связанных между собой классов, как «автор», «организация», «публикация», «доклад», «мероприятие». Профиль метаданных объектов каждого класса включает атрибуты, необходимые для получение развернутой информации как об отдельном объекте данного класса, так и о группе объектов, связанных заданными значениями атрибутов объектов других классов (например, перечень статей сотрудников заданного подразделения данной организации, опубликованных в заданном журнале за заданный промежуток времени). Отличительной особенностью системы является введенное понятие «эквивалентных» объектов. Эквивалентными считаются объекты, представленные в системе различными метаданными, но относящимися к одной физической сущности. Такими объектами являются «персоны», соответствующие одному автору с различными написаниями фамилии в библиографических описаниях публикаций; организации, имеющие различные варианты названий; статьи, опубликованные без изменений на различных языках. Подробно охарактеризованы возможности системы, ее пользовательский интерфейс, приведены примеры выполнения конкретных запросов.

Ключевые слова: базы данных, учет результатов научной деятельности, веб-ориентированная система, сетевые технологии, анализ публикационной активности, программное обеспечение.

О реализации веб-системы математической информации

А.С. Аджиев, А.Н. Бездушный, В.А. Серебряков
Аннотация: На основе проведенного ранее анализа российских математических электронных ресурсов, а так же опыта зарубежных математических информационных систем описан проект создаваемой математической информационной системы Math-Net.RU. Базовой платформой системы Math-Net.RU является универсальная информационная система ИСИР.
Проект описан в терминах перечня требований и условий, которым должна удовлетворять создаваемая система. Рассмотрены и проанализированы альтернативные варианты реализации различных компонент системы, а также пути решения возникающих при этом проблем. Очерчены категории хранимой информации, целевой круг пользователей системы и требуемая функциональность. Описана общая архитектура, схема данных, пользовательские интерфейсы, а также способы наполнения системы информацией, актуализации и синхронизации данных из других информационных систем и баз данных. Рассмотрены проблемы представления математических текстов и формул в информационных системах, дан сравнительный анализ существующих форматов хранения. Очерчены так же перспективы участия системы Math-Net.RU в создаваемой Всемирной математической информационной системе Math-Net, а также требования к системе-участнику.

Система ограничений генерации для устранения структурных ошибок при создании дерева зависимостей с помощью большой языковой модели

Елена Денисовна Шамаева
1269-1292
Аннотация:

Для синтаксического анализа естественного языка перспективным направлением является дообучение больших языковых моделей для генерации синтаксической структуры предложения в виде скобочной последовательности формата Grammatical Relation Centered Tree (GRCT). Существующие дообученные модели демонстрируют высокие значения метрик оценки качества синтаксического анализа, однако в некоторых случаях генерируют некорректную скобочную последовательность (например, с несбалансированным числом открывающих и закрывающих скобок). В работе разработан метод, позволяющий уменьшить количество некорректно сгенерированых последовательностей. Для этого создана многоэтапная система ограничений субтокенов, генерируемых на каждом этапе работы большой языковой модели. Реализация этого метода протестирована на 4 моделях (адаптированные и неадаптированные модели размерами 4 и 8 млрд параметров) на датасете деревьев зависимостей SynTagRus. Для всех моделей количество некорректно сгенерированных последовательностей уменьшилось. Дополнительно установлено, что такие ограничения на генерацию влияют на качество собственно синтаксического анализа (может происходить повышение или понижение метрик оценки качества синтаксического анализа). Реализованная система ограничений может быть использована для повышения надежности работы любой большой языковой модели, дообученной для синтаксического анализа в формате скобочной последовательности GRCT. Полученные результаты опубликованы в открытом доступе.

Ключевые слова: синтаксический анализ, большие языковые модели, дообучение, ограничение вывода, автоматическая обработка текстов.

Двухуровневая информационно-аналитическая система управления интеллектуальным светофором

Максим Владимирович Бобырь, Наталия Игоревна Храпова
696-717
Аннотация:

В современном мире проблемы, возникающие в сфере дорожного движения, имеют большую значимость. С целью решения существующих задач разрабатываются различные интеллектуальные системы, одной из которых является система «Умный город». Данная работа посвящена разработке информационно-аналитической системы (ИАС) для управления интеллектуальным светофором. Представленная система состоит из двух уровней, каждый из которых реализует набор определенных операций. Первый уровень отвечает за обнаружение объектов, в частности, пешеходов и автомобилей, находящихся на перекрестке, а второй уровень осуществляет расчёт времени работы сигналов светофора для управляющего сигнала, который передаётся на устройство. Для сравнительного анализа выбран комбинационный метод (HOG+SVM) Histogram of Oriented Gradients, основанный на подсчёте числа направлений градиента на отдельных областях изображения и Support Vector Machines, с помощью которого строятся гиперплоскости в n-мерном пространстве с целью разделения объектов, относящихся к разным классам. Результаты экспериментального исследования, в ходе которого проводилось распознавание объектов на изображениях, показали превосходство разработанной информационно-аналитической системы над существующими. Среднее значение точности выявления пешеходов и автомобилей посредством ИАС составило 69,4%. Кроме того, по результатам проведенного эксперимента сделан вывод, что точность выявления объектов на изображениях прямо пропорциональна расстоянию от видеокамеры до объекта.

Ключевые слова: интеллектуальный светофор, детектирование объектов, машинное обучение, нечётко-логический метод детектирования границ, YOLO, HOG, SVM.

Цифровая инфраструктура электронного научного журнала: автоматизация редакционно-издательских процессов и система сервисов

Миляуша Салахутдиновна Галявиева, Александр Михайлович Елизаров, Евгений Константинович Липачёв
408-465
Аннотация:

Описаны современные модели и средства публикации и распространения научных знаний. Охарактеризованы современные информационные системы управления научными изданиями и сервисы, определяющие их функциональность.

Введено понятие цифровой инфраструктуры электронного научного журнала как комплекса, который объединяет программную платформу, реализующую основные рабочие процессы управления электронным журналом, и информационные системы, которые обеспечивают функционирование как основных, так и дополнительных сервисов, учитывающих, в частности, специфику предметной области журнала.

Представлен подход к организации цифровой инфраструктуры электронного научного журнала на основе открытой программной системы Open Journal Systems (OJS). Предложены сервисы, расширяющие функциональные возможности этой системы и учитывающие специфику предметной области научных журналов. На основе технологии расширения функционала OJS созданы программные модули, обеспечивающие автоматизацию ряда редакционных процессов электронного научного журнала.

Представлена система сервисов автоматической обработки коллекций научных документов. Эти сервисы обеспечивают проверку соответствия документов коллекций принятым правилам формирования коллекций и преобразования документов в установленные форматы; структурный анализ документов и извлечение метаданных, а также их интеграцию в научное информационное пространство. Система сервисов позволяет автоматически выполнять набор операций, который не реализуем за практически приемлемое время при традиционной «ручной» обработке электронного контента, и предназначена для обработки больших коллекций научных документов.

Охарактеризованы алгоритмы автоматической стилевой валидации текстов на этапе регистрации статьи в информационной системе электронного научного журнала, автоматического подбора рецензентов, рассылки уведомлений и контроля сроков рецензирования.

Представлены методы обработки документов, содержащих математические формулы, в частности, алгоритм поиска по формулам в коллекциях математических документов. Указаны основные идеи, подходы и уже полученные результаты по разработке семантических технологий управления математическими знаниями, в том числе, подход к построению рекомендательных систем на основе онтологий математического знания и метод автоматизации процесса первичной обработки научной статьи, использующей TеX-нотацию.

Охарактеризована проблема построения системы анализа и оценки информационного и социального воздействия публикуемого научного контента на его пользователей. Проведено сопоставление традиционных (библиометрических и наукометрических) и альтернативных показателей такой оценки. Описан мировой опыт использования информетрических сервисов на сайтах научных журналов. Обсуждены варианты реализации этих подходов в рамках цифровой инфраструктуры электронного научного журнала.

Ключевые слова: издательские системы, современные модели публикации и распространения научных знаний, информационное общество, электронный научный журнал, информационные системы управления научными изданиями и публикациями, интеграция электронных ресурсов.

Базовые сервисы фабрики метаданных цифровой математической библиотеки Lobachevskii-DML

336-381
Аннотация: Решен ряд задач, связанных с построением фабрики метаданных цифровой математической библиотеки Lobachevskii-DML. Под фабрикой метаданных понимается система взаимосвязанных программных инструментов, направленных на создание, обработку, хранение и управление метаданными объектов цифровых библиотек и позволяющих интегрировать создаваемые электронные коллекции в агрегирующие цифровые научные библиотеки. С целью выбора оптимальных таких программных инструментов из существующих и их модернизации: обсуждены особенности представления метаданных документов различных электронных коллекций, связанные как с применяемыми форматами, так и с изменениями состава и полноты набора метаданных в течение всего времени издания соответствующего научного журнала;представлены и охарактеризованы программные инструменты управления научным контентом и методы организации автоматизированной интеграции репозиториев математических документов с другими информационными системами;обсуждена такая важная функция фабрики метаданных цифровой библиотеки, как нормализация метаданных в соответствии с форматами других агрегирующих библиотек.В результате разработки фабрики метаданных цифровой математической библиотеки Lobachevskii-DML предложена система сервисов автоматизированного формирования метаданных электронных математических коллекций; разработан xml-язык представления метаданных, основанный на Journal Archiving and Interchange Tag Suite (NISO JATS); созданы программные инструменты нормализации метаданных электронных коллекций научных документов в форматах, разработанных международными организациями – агрегаторами ресурсов по математике и Computer Science; разработан алгоритм приведения метаданных к формату oai_dc и генерации структуры архивов для импорта в цифровое хранилище DSpace; предложены и реализованы методы интеграции электронных математических коллекций Казанского университета в отечественные и зарубежные цифровые математические библиотеки.
Ключевые слова: цифровые библиотеки, цифровая математическая библиотека, формирование метаданных, извлечение метаданных, нормализация метаданных, фабрика метаданных, NISO JATS, семантические связи, Lobachevskii-DML.

Система автоматического формирования, обработки и управления метаданными документов электронных коллекций

Алмаз Рустамович Хамеджанов
937-959
Аннотация:

В настоящее время издательский цикл претерпевает значительные технологические изменения: внедряются автоматизированные системы управления публикационными процессами, используются нейросетевые технологии для обработки контента, активно развиваются инструменты интеллектуального анализа научных данных. Одним из ключевых трендов становится автоматизация издательского цикла, направленная на ускорение обработки рукописей, повышение качества метаописания и обеспечение совместимости информационных ресурсов. В этом контексте метаданные выступают связующим элементом для машинной обработки и навигации в пространстве научных знаний, обеспечивая структурирование информации, ее интерпретацию и интеграцию в цифровые библиотечные системы. Однако метаданные научных публикаций часто содержат ошибки, неточности или являются неполными, а их ручное формирование и уточнение требуют значительных временных затрат и не обеспечивают высокой точности. В работе представлена система автоматического формирования, обработки и управления метаданными научных документов на основе данных, полученных из сервисов поиска научных публикаций и открытых баз знаний. Эта система может использоваться для автоматизации процесса извлечения, уточнения и дополнения метаданных научных публикаций с целью последующего формирования электронных коллекций научных документов.

Ключевые слова: цифровая математическая библиотека, семантическая сеть, автоматизация редакционных процессов, формирование метаданных, извлечение метаданных, дополнение метаданных, NISO JATS, цифровая библиотека.

Семантический рекомендательный сервис присвоения кода УДК математическим статьям

Ольга Авенировна Невзорова, Дамир Альбертович Альмухаметов
203-224
Аннотация:

Классификация документов с присвоением кодов-классификаторов является традиционным способом систематизации и поиска документов по определенной тематике. Универсальная десятичная классификация (УДК) лежит в основе систематизации знаний, представленных в библиотеках, базах данных и других хранилищах информации. В России УДК является обязательным реквизитом всей книжной продукции и информации по естественным и техническим наукам. Выбор классификационных кодов связан с анализом структуры дерева классификатора и традиционно выполняется автором научной статьи.


В настоящей работе предложено решение задачи автоматизации подбора классификационного кода УДК для математической статьи на основе специального ресурса – онтологии OntoMathPRO профессиональной математики, разработанной в Казанском федеральном университете. Подходом к решению задачи автоматизации является создание «кодовых карт» для каждого классифицирующего кода в дереве УДК в области математики. Под «кодовой картой» понимается взвешенный набор всех математических именованных сущностей, извлеченных с помощью онтологии OntoMathPRO из коллекции статей с заданным кодом УДК. Создание «кодовых карт» основано на гипотезе о том, что выбор кода УДК обуславливается определённым набором классифицирующих признаков, которые можно представить классами из онтологии OntoMathPRO. Предложенная гипотеза проверена и подтверждена: проверка гипотезы проведена на коллекции математических статей, опубликованных в журнале «Известия ВУЗов. Математика» в течение 1999–2009 гг.

Ключевые слова: Универсальная десятичная классификация, кодовая карт, кодовая карта, онтология OntoMathPRO, математическая статья.

Восстановление многомерной формы обращений к линеаризованным массивам в системе SAPFOR

770-787
Аннотация: Система автоматизированного распараллеливания SAPFOR (System FOR Automated Parallelization) включает инструменты для анализа и преобразования программ, основной ее целью является снижение сложности распараллеливания программ. Система SAPFOR ориентирована на исследования многоязыковых вычислительных комплексов, разрабатываемых на языках программирования Фортран и Си. Для анализа программ в этой системе используется низкоуровневое их представление в виде LLVM IR, которое позволяет проводить различные оптимизации с целью повышения качества анализа программ. При этом оно теряет некоторые особенности программы, отражаемые ее представлением на языке высокого уровня. Одной из таких особенностей является многомерная структура используемых массивов. Анализ зависимостей по данным является одним из ключевых при исследовании возможности параллельного выполнения программ. При этом такой анализ относится к классу NP-трудных задач. Знание многомерной структуры массивов позволяет во многих случаях учесть структуру индексных выражений в обращениях к массивам и снизить сложность проводимого анализа. Кроме того, использование многомерных массивов позволяет повысить уровень параллелизма в программе за счет использования многомерных решеток процессоров и распараллеливания гнезд циклов, а не отдельных циклов в гнезде. Данная возможность естественным образом поддерживается в DVM-системе. В настоящей работе рассмотрен подход, применяемый в системе SAPFOR для восстановления формы многомерных массивов и обращений к ним по их линеаризованному представлению в LLVM IR. Предложенный подход был успешно протестирован на различных приложениях, включая тесты производительности из набора NAS Parallel Benchmarks.
Ключевые слова: анализ программ, автоматизация распараллеливания, SAPFOR, DVM, LLVM.

Рекомендательная система поиска семантически близких фрагментов программного кода

Виталий Иванович Зорин, Евгений Константинович Липачев
751-781
Аннотация:

Рекомендательные системы в научном информационном пространстве являются инструментом поиска и навигации при работе с научными документами. Программный код в настоящее время рассматривается как объект научного знания, и, как следствие, важной задачей является создание систем поддержки жизненного цикла программ, в частности поиска близких программных решений, обнаружения заимствований программного кода, анализа и оценки качества кода. В работе предложена рекомендательная система, формирующая для пользователя персонализированный список фрагментов кода, функционально эквивалентных входному коду-запросу, представленному на одном из языков программирования из установленного набора. Базовый алгоритм системы основан на представлении программного кода в виде абстрактного синтаксического дерева с последующим построением векторного пространства программных кодов. Семантическое сходство программных кодов определяется по расстоянию между векторами кодов в многомерном пространстве. Персонализация выдачи достигается за счет модуля фильтрации, который ранжирует найденные фрагменты с учетом профиля пользователя. Рассматриваемыми факторами являются языковые предпочтения пользователя и его области научных интересов, извлекаемые посредством интеграции с ORCID. Для обеспечения работы системы на основе корпуса CodeNet создан специализированный набор фрагментов программного кода. Решена также задача автоматического определения языка программирования по фрагменту представленного кода на одном из языков, входящих в текущий рейтинговый список языков программирования.

Ключевые слова: абстрактное синтаксическое дерево, векторизация кода, контентная фильтрация, кросс языковой поиск, межъязыковой программный клон, рекомендательная система, сходство программного кода.

Сокрытие в смысле: семантическое кодирование для генеративно-текстовой стеганографии

Олег Юрьевич Рогов, Дмитрий Евгеньевич Инденбом, Дмитрий Сергеевич Корж, Дарья Валерьевна Пугачёва, Всеволод Александрович Воронов, Елена Викторовна Тутубалина
1165-1185
Аннотация:

В статье предложена новая система для генерации стеганографического текста, скрывающая двоичные сообщения в семантически связном естественном языке с помощью скрытого пространства, обусловливающего большие языковые модели (LLM). Секретные сообщения сначала кодируются в непрерывные векторы с помощью обученного отображения двоичного кода в скрытое пространство, которое используется для управления генерацией текста посредством донастройки префикса. В отличие от предыдущих методов стеганографии на уровне токенов или синтаксиса, наш метод позволяет избежать явной манипуляции словами и вместо этого работает полностью в скрытом семантическом пространстве, что обеспечивает более плавные и менее заметные результаты. На стороне получателя скрытое представление восстанавливается из сгенерированного текста и декодируется обратно в исходное сообщение.
В качестве ключевого теоретического вклада мы предоставляем гарантию надежности: если восстановленный скрытый вектор находится в пределах ограниченного расстояния от изначального, обеспечивается точное восстановление сообщения, причем граница определяется константой Липшица декодера и минимальным отступом логитов. Этот формальный результат предлагает принципиальный подход к компромиссу между надежностью и емкостью в скрытых стеганографических системах. Эмпирическая оценка как на синтетических данных, так и в практических предметных областях, таких как отзывы на Amazon, показывает, что наш метод достигает высокой точности восстановления сообщений (выше 91%), высокую плавность текста и конкурентоспособную емкость до 6 бит на элемент предложения, сохраняя при этом устойчивость к нейронному стегоанализу. Эти результаты демонстрируют, что генерация со скрытым условием предлагает безопасный и практичный путь для встраивания информации в современные LLM.

Ключевые слова: стеганография, семантическое кодирование, языковые модели, донастройка префиксов, граф знаний, генерация естественного языка, скрытое обусловливание, нейронный стегоанализ.

Технология ситуационного моделирования в системах виртуального окружения

Михаил Васильевич Михайлюк, Дмитрий Алексеевич Кононов, Дмитрий Михайлович Логинов
889-901
Аннотация:

Обсуждена технология моделирования различных ситуаций в системах виртуального окружения, которые являются компьютерными трехмерными моделями реальной или искусственной среды. Пользователь может рассматривать эти сцены непосредственно на экране компьютера, настенном экране, в стерео очках, в очках виртуальной реальности и т. д. Он также может перемещаться внутри виртуальной сцены и взаимодействовать с ее объектами. В свою очередь среда также может изменяться. Это позволяет проводить в системе виртуального окружения моделирование различных ситуаций (ситуационное моделирование). При таком моделировании задается некоторая статическая или динамическая обстановка в системе виртуального окружения, в которой оператор должен выполнить поставленные перед ним задачи.


Предложен механизм задания ситуаций путем изменения виртуальной трехмерной сцены с помощью конфигурационных файлов и виртуальных пультов управления. Для записи конфигурационных файлов разработан специальный язык, а для создания виртуальных пультов управления – специальный редактор. Представлена апробация предложенных методов на примере двух виртуальных сцен: полигона для мобильных роботов и реактивного рюкзака спасения космонавта в открытом космосе.

Ключевые слова: открытый доступ, система виртуального окружения, ситуационное моделирование, трехмерная сцена, конфигурационный файл, виртуальный пульт управления.

О моделировании функционирования оборонных отраслей экономики: информационная поддержка

566-575
Аннотация: При обработке огромных объемов информации, возникающих в процессе деятельности отдельных организаций и целых отраслей экономики нужны новые подходы и решения. Для эффективной конверсии национальной оборонной промышленности разрабатывается информационно-аналитическая система. В работе обсуждается создаваемый инструментарий систематизации открытых данных о продукции военного назначения и оборонно-промышленном потенциале. В частности, разрабатывается ресурс, который будет играть роль своего рода агрегатора указанной информации.
Ключевые слова: оборонно-промышленный комплекс, научно-промышленная политика, информационная поддержка, сетевые информационные ресурсы, базы данных.

Семантический анализ документов в системе управления цифровыми научными коллекциями

Шамиль Махмутович Хайдаров
61-85
Аннотация: Предложены методы семантического анализа документов в системе управления цифровыми научными коллекциями, в том числе электронными научными журналами. Рассмотрены методы обработки документов, содержащих математические формулы, а также способы конвертации этих документов из формата OpenXML в формат TeX. Разработан алгоритм поиска по формулам в коллекциях математических документов, хранящихся в формате OpenXML. Алгоритм реализован в виде онлайн-сервиса на платформе science.tatarstan.
Ключевые слова: семантический анализ, издательские системы.

Cемантические сервисы цифровой экосистемы ontomath для математического образования

Ольга Авенировна Невзорова, Евгений Константинович Липачёв, Константин Сергеевич Николаев
538-569
Аннотация:

Представлен набор семантических сервисов, разработанных с целью поддержки образовательного процесса в области математики. Функционал этих сервисов основан на использовании математических онтологий OntoMathEdu и OntoMathPRO. Онтология профессионального математического знания OntoMathPRO предназначена для классификации и систематизации математических понятий и включает несколько важнейших областей математики. Образовательная математическая онтология OntoMathEdu системно представляет знания по учебному курсу «Планиметрия». Для применения онтологий в образовательных приложениях разработан подход к проектированию пререквизитных отношений в названных онтологиях. Для поддержки математического образования разработаны сервисы семантического поиска по математическим формулам, семантического аннотирования учебных материалов, визуализации подграфов семантической сети онтологии OntoMathEdu, а также параллельный формальный/неформальный корпус математических утверждений и система автоматической генерации тестовых вопросов по математическим дисциплинам.


Приведены примеры успешного применения разработанных программных инструментов. Эти инструменты встроены в цифровую экосистему OntoMath, в рамках которой осуществляется взаимодействие семантических сервисов управления математическим знанием.  

Ключевые слова: Цифровая экосистема, экосистема OntoMath, предметная онтология, математическая онтология OntoMathPRO, образовательная онтология OntoMathEdu, пререквизитное отношение, семантический сервис.

Автоматизированная система реставрации и обработки изображений старопечатных текстов и рукописей

В.С. Южиков
Аннотация: В статье описывается программная система для реставрации изображений старопечатных текстов и рукописей, а также основные подходы и методы для решения данной задачи.

Создание экосистемы по обработке данных для научных исследований в области геологии

Виталий Сергеевич Ерёменко, Вера Викторовна Наумова
336-347
Аннотация:

Рассмотрены разнородные территориально-распределённые вычислительные системы по обработке геологических данных и подходы по организации взаимодействия с этими системами. Исследуемые системы классифицированы на несколько групп, исходя из принципов их функционирования и выбранных технологических решений. Для каждого типа систем приведено описание их основных свойств, включая возможные способы для взаимодействия.


На основе проведённого анализа предложен подход к организации единого рабочего пространства с доступом к разнородным территориально-распределённым вычислительным системам в рамках общей экосистемы. Описаны архитектура предлагаемой экосистемы и правила взаимодействия её участников. Продемонстрирован программный прототип, реализующий названные принципы, на примере нескольких разнородных систем по обработке геологической информации.

Ключевые слова: вычислительно-аналитическая среда, облачные сервисы, веб-сервисы, программные платформы.

Аналитическая система мультитрейдинга

Феликс Освальдович Каспаринский
796-945
Аннотация:

Аналитическая система мультитрейдинга, представленная в статье, разработана для оперативного, тактического и стратегического прогнозирования изменения цен различных финансовых инструментов на рынке Форекс с использованием компьютерного интернет-терминала Metatrader 5. В Аналитических окнах терминала организовано функциональное распределение 17 индикаторов технического анализа по секциям Цены, Осцилляций, Трендов и Контроля. При настройке комплексных индикаторов Уровня Равновесия Цены, Распределения Осцилляций, Потенциала Тренда и Тренда Групп Осцилляций используется методика подключения трендовых индикаторов к данным осцилляторов. Комплексные индикаторы демаскируют стадии формирования элементарных ценовых осцилляций и их групп (пакетов из 4 осцилляций, блоков из 2 пакетов и модулей из 4 блоков), помогают устанавливать местонахождение опорных точек ценовых каналов. Для синхронного анализа оперативных, тактических и стратегических тенденций изменения цен одного финансового инструмента в Аналитический дисплей объединяются шесть Аналитических окон с последовательным увеличением масштабов времени интервальных графиков в 4 раза. Разработан регламент мультимасштабной разметки, оформления и использования Вил Эндрюса для прогноза долговременных тенденций. Оперативные и тактические прогнозы визуализируются посредством мультимасштабных трендовых стрелок в Зоне Актуальных Осцилляций. Предложена методика объединения инструментария фундаментального и технического анализа для определения вероятности начала и относительной значимости фундаментальных событий, не содержащихся в экономическом календаре.

Ключевые слова: мультитрейдинг, трейдинг, форекс, инвестиции, технический анализ, фундаментальный анализ, индикатор, торговый сигнал, ценовой канал, Вилы Эндрюса, осцилляция, пакет, блок, модуль.

Выпускная квалификационная работа: интеллектуальная собственность, источник персональных данных. правовые проблемы при проверке и использовании

Павел Петрович Гейко
305-321
Аннотация:

Затронуты проблемы правового характера, возникающие в связи с необходимостью осуществления обязательной проверки выпускных квалификационных работ на наличие заимствований при проведении итоговой аттестации по образовательным программам высшего образования, размещения этих работ в электронно-библиотечных системах образовательных организаций. В частности, исследованы вопросы необходимости соблюдения законодательства о персональных данных при обработке персональных данных в ходе проведения проверок работ на наличие заимствований, размещения работ в библиотечных системах. Уделено внимание вопросам соблюдения интеллектуальных прав авторов выпускных квалификационных работ при выполнении образовательными организациями возложенных на них обозначенных обязанностей. Анализ правовых проблем проведен с учетом внесенного Правительством РФ законопроекта, которым на образовательные организации высшего образования предлагается возложить обязанность по размещению в открытом доступе на официальном сайте образовательной организации в интернете полных текстов выпускных квалификационных работ по программам магистратуры и программам специалитета.

Ключевые слова: оригинальность, уникальность, обнаружение заимствований, плагиат, персональные данные, интеллектуальные права, исключительные права, квалификационная работа, учебная работа, научная работа, автор, размещение работ, обнародование, электронно-библиотечная с.

Описание и использование тезаурусов в информационных системах, подходы и реализация

М.Х. Нгуен, А.С. Аджиев
Аннотация: В статье рассмотрены разные подходы к формализации тезаурусов, а также стандарты ISO, ANSI и ГОСТ. Сделан анализ некоторых возможных платформ для такой формализации, описаны особенности работы с тезаурусами в информационных системах, а также проблемы при этом возникающие, требования к реализации тезауруса в рамках SemanticWeb [12].
Рассмотрены особенности и различия классификаторов ресурсов и обычных терминологических и лингвистических тезаурусов. Дан сравнительный анализ существующих схем данных и подходов к реализации тезаурусов для информационных систем на основе RDF. Рассмотрены также вопросы организации пользовательских интерфейсов для работы с тезаурусами, и использования их при поиске в информационной системе, а также интерфейсы администрирования тезаурусов.
Во второй части статьи на основании проделанного анализа сформулированы требования к описанию тезауруса в ИСИР, и приведена общая универсальная схема данных для представления тезауруса в этой информационной системе, удовлетворяющая перечисленным требованиям, и небольшой пример реализации в ней классификатора MSC.
На основании предложенной общей универсальной схемы и сформулированных требований описана реализация тезауруса в ИСИР.
1 - 25 из 137 результатов 1 2 3 4 5 6 > >> 
Информация
  • Для читателей
  • Для авторов
  • Для библиотек
Отправить материал
Текущий выпуск
  • Логотип Atom
  • Логотип RSS2
  • Логотип RSS1

Электронные библиотеки

ISSN 1562-5419

Информация

  • О журнале
  • Цели и задачи
  • Тематика
  • Руководство для авторов
  • Отправка материалов
  • Заявление о конфиденциальности
  • Контакты
  • eLIBRARY.RU
  • dblp computer science bibliography

Отправить статью

Авторам нужно зарегистрироваться в журнале перед отправкой материалов, или, если вы уже зарегистрированы, можно просто войти со своей учетной записью и начать процесс отправки, состоящий из пяти шагов.

Отправить материал
Больше информации об этой издательской системе, платформе и рабочем процессе от OJS/PKP.

© 2015-2026 Казанский (Приволжский) федеральный университет; Институт развития информационного общества