• Main Navigation
  • Main Content
  • Sidebar

Электронные библиотеки

  • Главная
  • О нас
    • О журнале
    • Цели и задачи
    • Тематика
    • Главный редактор
    • Редакция
    • Отправка материалов
    • Заявление об открытом доступе
    • Заявление о конфиденциальности
    • Контакты
  • Текущий выпуск
  • Архивы
  • Регистрация
  • Вход
  • Поиск
Издается с 1998 года
ISSN 1562-5419
16+
Language
  • Русский
  • English

Найти

Расширенные фильтры

Результаты поиска

Онтология вспомогательных и политематических предметных классов единого цифрового пространства научных знаний

Светлана Александровна Власова, Николай Евгеньевич Каленов, Александр Николаевич Сотников
22-42
Аннотация:

Одними из основных компонентов Единого Цифрового Пространства Научных Знаний (ЕЦПНЗ) являются предметные онтологии отдельных тематических подпространств, включающие в себя основные понятия, относящиеся к данному научному направлению. Задача построения предметных онтологий на первом этапе требует формирования массива ключевых терминов в заданной области науки с последующим установлением связей между ними. Настоящая работа является развитием исследований, проводимых авторами в области создания ЕЦПНЗ. В рамках предыдущих исследований была предложена унифицированная структура представления онтологии элементов ЕЦПНЗ (подпространств, классов и атрибутов объектов, связей между объектами или атрибутами). В процессе моделирования онтологии на примере универсального и ряда тематических подпространств ЕЦПНЗ выявилась необходимость некоторой корректировки структуры онтологии, касающейся справочников ЕЦПНЗ, для обеспечения возможности описания вложенных атрибутов данных. Кроме того, в онтологию введено понятие «тип словаря значений атрибутов данных», определены два типа словарей – «статические» и «динамические». Эта информация позволяет упростить алгоритмы формально-логического контроля при формировании контента ЕЦПНЗ. Указание на тип словаря введено в структуру справочников атрибутов объектов. В представленной работе описана модифицированная структура онтологии на примере 11-ти вспомогательных и 10-ти предметных классов универсального подпространства (УПП) ЕЦПНЗ. Приведены примеры справочников каждого класса, построенные в соответствии с моделью структуры онтологии, перечень атрибутов объектов и примеры статических словарей.

Ключевые слова: цифровое пространство научных знаний, онтология, классы объектов, атрибуты, структуризация, связанные данные.

Унифицированное представление онтологии единого цифрового пространства научных знаний

Николай Евгеньевич Каленов, Александр Николаевич Сотников
80-103
Аннотация:

Единое цифровое пространство научных знаний (ЕЦПНЗ) представляет собой цифровую информационную среду, агрегирующую разнородную информацию, связанную с различными аспектами научных знаний. Одной из важных функций ЕЦПНЗ является предоставление информации для решения задач искусственного интеллекта, что обусловливает необходимость поддержки данных в структуре, соответствующей правилам Semantic Web. Особенностями ЕЦПНЗ являются, с одной стороны, политематичность и разнородность элементов контента, с другой – высокая динамика появления новых видов объектов и связей между ними, что обусловлено спецификой развития науки. При реализации ЕЦПНЗ должна быть обеспечена возможность навигации по разнородным ресурсам пространства с использованием семантических связей между ними. Возможности ЕЦПНЗ в значительной мере определяются структурой онтологии пространства, модель которой предложена в данной работе. В рамках модели проведена иерархическая структуризация онтологии ЕЦПНЗ; выделены и определены такие элементы, как «подпространство», «класс объектов», «объект», «атрибуты объекта», три типа попарных связей объектов и атрибутов (универсальные, квазиуниверсальные и специфические). Структура каждого типа элементов определяется «справочником» унифицированного вида; конкретные значения атрибутов и связей содержатся в словарях унифицированной структуры. Выделен класс объектов «Форматы», описывающих правила формирования атрибутов и значений связей. Предложена формализация представлений справочников и словарей ЕЦПНЗ. Предлагаемая модель позволяет достаточно просто добавлять в пространство, по мере необходимости, новые виды объектов, их попарных связей и атрибутов.

Ключевые слова: цифровое пространство научных знаний, онтологии, структуризация, связанные данные, атрибуты данных, семантический WEB.

Атрибуция архивных рукописных писем с использованием сиамских нейронных сетей

Наталия Михайловна Пронина
1454-1480
Аннотация:

Предложен метод автоматической атрибуции архивных рукописных писем на основе сиамской нейронной сети, решающий ключевую проблему цифровой гуманитаристики – установление авторства исторических документов. Актуальность исследования обусловлена массовой оцифровкой архивов XVII–XIX вв., атрибуция которых затруднена из-за неполных исходных сведений об авторах.


Метод адаптирован к работе с реальным корпусом текстов и учитывает характерные для архивов проблемы: некачественные оцифровки, значительную вариативность почерка и выраженный дисбаланс классов (от 1 до 50 и более образцов на автора). Применение сиамской архитектуры позволяет получать дискриминативные векторные представления, эмбеддинги, на основе которых выполняется не только классификация документов известных авторов, но и эффективно выявляются рукописи, не принадлежащие ни одному из них. Это сужает круг кандидатов для последующей экспертной проверки.


Представлен алгоритм предобработки данных и проведено сравнительное исследование двух подходов к анализу текста: на уровне фрагментов изображения (300 × 300 пикселей) и уровне отдельных строк. Разработанный инструмент предлагает архивным работникам и филологам эффективное решение для предварительной сортировки и атрибуции крупных массивов рукописных документов.

Ключевые слова: сиамская нейронная сеть, идентификация, верификация, атрибуция, рукописный текст, архивные документы, сверточная нейронная сеть, рекуррентная нейронная сеть.

Как в библиографической ссылке «На лету» формируется дата размещения последней версии публикации

Михаил Михайлович Горбунов-Посадов
554-565
Аннотация:

Размещенную в интернете научную работу, которую ее автор постоянно поддерживает в актуальном состоянии, будем называть живой публикацией. У жанра живой публикации есть множество привлекательных черт. Однако он требует определенного расширения состава метаатрибутов публикации: наряду с традиционными атрибутами здесь на первый план выдвигается дата появления очередной, свежей редакции. Такая дата размещается на видном месте в тексте публикации. Наряду с этим весьма желательной становится включения такой динамически («на лету») формируемой даты в библиографическую ссылку на живую публикацию.


В статье рассмотрены применяющиеся сейчас способы динамического извлечения искомой даты для простой онлайновой публикации, для публикации, получившей DOI посредством Crossref, и для публикаций, размещенных в arXiv.org и preprints.org.

Ключевые слова: живая публикация, динамический компонент библиографической ссылки, свежая дата редакции, Crossref, arXiv.org, Preprints.org.

Информационная система регистрации результатов интеллектуальной деятельности сотрудников научного учреждения

Светлана Александровна Власова, Николай Евгеньевич Калёнов
218-237
Аннотация:

Представлена разработанная авторами объектно-ориентированная веб-система, предназначенная для формирования метаданных, описывающих результаты научной деятельности сотрудников учреждения (группы учреждений), и предоставления различных справочно-статистических данных о публикациях и докладах, сделанных ими на научных конференциях, симпозиумах, семинарах. Система ориентирована на работу с объектами таких связанных между собой классов, как «автор», «организация», «публикация», «доклад», «мероприятие». Профиль метаданных объектов каждого класса включает атрибуты, необходимые для получение развернутой информации как об отдельном объекте данного класса, так и о группе объектов, связанных заданными значениями атрибутов объектов других классов (например, перечень статей сотрудников заданного подразделения данной организации, опубликованных в заданном журнале за заданный промежуток времени). Отличительной особенностью системы является введенное понятие «эквивалентных» объектов. Эквивалентными считаются объекты, представленные в системе различными метаданными, но относящимися к одной физической сущности. Такими объектами являются «персоны», соответствующие одному автору с различными написаниями фамилии в библиографических описаниях публикаций; организации, имеющие различные варианты названий; статьи, опубликованные без изменений на различных языках. Подробно охарактеризованы возможности системы, ее пользовательский интерфейс, приведены примеры выполнения конкретных запросов.

Ключевые слова: базы данных, учет результатов научной деятельности, веб-ориентированная система, сетевые технологии, анализ публикационной активности, программное обеспечение.

Когнитивная адаптация параметров скользящего окна больших языковых моделей на основе быстродействующего метода отношения площадей

Екатерина Олеговна Брежнева
1906-1923
Аннотация:

Предложен метод адаптивного управления параметрами скользящего окна больших языковых моделей на основе нечеткого вывода Мамдани с дефаззификацией по быстродействующему методу отношения площадей (MAR-II). Управляющими переменными являются индекс лексического разнообразия (TTR) и средняя длина BPE-токена (ATL), интерпретируемые как измеримые корреляты когнитивной нагрузки текстового фрагмента. Нечеткий регулятор на основе девяти правил вырабатывает шаг скользящего окна (stride) и длину контекста (max_length). Проведено сравнение MAR-II с методом центра тяжести (CoG) на сетке 25 × 25 точек входного пространства (RMSE по stride 99.9 токена, по max_length 147.4 токена). Показано, что MAR-II обеспечивает аддитивность нечеткой модели и устраняет систематические ошибки CoG при времени вычисления одного нечеткого вывода около 35 нс на ПЛИС Xilinx Spartan 3E.

Ключевые слова: когнитивное моделирование, нечеткая логика, метод отношения площадей, скользящее окно, языковая модель, ПЛИС, дефаззификация, нечеткий регулятор Мамдани.

Cистема контролируемой генерации лица, построенная с использованием сети StyleGAN2

Марат Вильданович Исангулов, Разиль Рустемович Миннеахметов, Алмаз Рустамович Хамеджанов, Тимур Робертович Хафизьянов, Эмиль Асифович Пашаев, Эрнест Ришатович Калимуллин
466-482
Аннотация:

Представлен новый подход к контролируемой генерации лиц, использующий генеративные модели с открытым исходным кодом, включая StyleGAN2 и Гребневую регрессию. Разработана методология, расширяющая возможности StyleGAN2 для контроля характеристик лиц, таких как возраст, раса, пол, выражение лица и атрибуты волос, а также использован обширный набор данных человеческих лиц с аннотациями атрибутов. Лица закодированы в 256-мерном латентном пространстве с использованием кодировщика StyleGAN2, что привело к набору характерных латентных кодов. Применен алгоритм t-SNE для кластеризации этих кодов на основе признаков, продемонстрирована возможность контроля генерации лиц, впоследствии обучены модели регрессии Риджа для каждого измерения латентных кодов с использованием размеченных признаков. При декодировании с использованием StyleGAN2 полученные коды успешно восстанавливали изображения лиц, сохраняя связь с входными признаками. Разработанный подход дает легкий и эффективный способ контролируемой генерации лиц с использованием существующих генеративных моделей, таких как StyleGAN2, и открывает новые возможности для различных областей применения.

Ключевые слова: машинное обучение, генерация лица, StyleGan, энкодер, декодер, скрытые коды, отображение признаков, гребневая регрессия.

Археометрия медных монет золотоордынского времени с болгарского городища как инструмент искусственного интеллекта

Резида Хавиловна Храмченкова, Джамиль Габдрахимович Мухаметшин, Артем Александрович Елизаров , Айрат Габитович Ситдиков, Павел Владимирович Федан
1445-1476
Аннотация:

Представлена пионерская работа в области изучения химического состава на микропримесном уровне медных археологических монет как информационной основы для выявления особенностей денежного обращения в средневековом государстве.


Проведено междисциплинарное исследование нумизматического материала с Болгарского городища из 98 медных монет, представленного 91 золотоордынской, шестью иноземными монетами того же периода и одной монетой домонгольского времени династии Зенгидов. Статья содержит атрибуцию с изображениями аверса и реверса монет, а также данные археометрического изучения денежных артефактов на предмет химического состава двумя независимыми методами – рентгенофлуоресцентным и эмиссионным спектральным.


На настоящий момент это первое междисциплинарное исследование в нашей стране, охватившее представительную коллекцию медных денег различных правителей и монетных дворов из археологических материалов Болгарского городища. В результате изучения химического состава монет были определены соотношения примесей в медных сплавах, что позволило разделить коллекцию на десять основных групп, включающих монеты различных чеканных дворов и правителей определенной датировки. Определение примесного состава позволяет не только классифицировать монеты по группам, но и выдвигать обоснованные гипотезы о географическом расположении месторождений меди, использовавшейся для чеканки.


База данных, сформированная по результатам исследования и объединяющая нумизматическую атрибуцию, изображения монет и данные об их химическом составе, опубликована как открытый набор данных в репозитории Zenodo и предназначена для применения методов машинного обучения и искусственного интеллекта в задачах автоматической идентификации и провениенс-анализа средневековых монет.

Ключевые слова: медные монеты династии Джучидов, химический состав, нумизматические данные, Болгарское городище, эмиссионный спектральный анализ, рентгенофлуоресцентный анализ, провениенс-анализ, археологические датасеты, машинное обучение, цифровая нумизматика.

Электронные текстовые ресурсы и долговременное хранение данных в Карельском научном центре РАН

Андрей Анатольевич Крижановский, Анатолий Дмитриевич Сорокин, Виктор Алексеевич Лебедев, Эльвира Викторовна Ямса, Валентина Геннадьевна Старкова, Юлия Андреевна Новикова, Александр Владимирович Чирков, Наталья Борисовна Крижановская, Юлия Васильевна Чиркова
305-367
Аннотация:

Описаны электронные ресурсы Карельского научного центра РАН, связанные с работой электронных библиотек, репозиториев и поисковых систем. Эти ресурсы предназначены для сбора, организации и распространения научной и технической информации (в виде научных публикаций, архивных документов) с целью ее использования в теоретических и прикладных научных дисциплинах. Охарактеризованы этапы разработки названных ресурсов на фоне истории развития отдельных, связанных с ними подразделений (Научная библиотека, Научный архив). Предложены направления развития электронных ресурсов Центра.

Статья распространяется на правах свободной лицензии Creative Commons Attribution-ShareAlike 4.0.

Ключевые слова: Карельский научный центр РАН, электронное архивирование, электронная библиотека.

Моделирование фрагментов контента Единого цифрового пространиства научных знаний

Светлана Александровна Власова, Николай Евгеньевич Каленов, Александр Николаевич Сотников
353-368
Аннотация:

Представлены новые результаты исследований, связанных с формированием Единого цифрового пространства научных знаний (ЕЦПНЗ). Работы в этом направлении ведутся с 2019 г. в ряде академических организаций, в том числе в Межведомственном суперкомпьютерном центре Российской академии наук (ныне Отделение суперкомпьютерных систем и параллельных вычислений Научно-исследовательского центра «Курчатовский институт»). В рамках этих исследований предложены структура онтологии ЕЦПНЗ и язык для ее описания, а также разработан ряд унифицированных программных средств, обеспечивающих формирование онтологии отдельных подпространств и ввод в ЕЦПНЗ различных типов и видов атрибутов объектов и именованных связей. В настоящее время проводится моделирование формирования контента ЕЦПНЗ на примере универсального и ряда тематических подпространств. В работе представлены результаты этого моделирования. Приведены атрибуты и связи объектов класса «Административные единицы», относящихся к подпространству «География», классов «Организации и их подразделения» и «Классификационные системы» универсального подпространства. Продемонстрирована возможность навигации по загруженным реальным ресурсам.

Ключевые слова: пространство научных знаний, онтология, именованные связи, загрузка данных, российские административные единицы, гербы городов.

Классификация изображений с помощью сверточных нейронных сетей

Сергей Алексеевич Филиппов
366-382
Аннотация:

Для классификации изображений в настоящее время можно применить множество различных инструментов, каждый из которых направлен на решение определенного спектра задач. В статье проведен краткий обзор библиотек и технологий для классификации изображений. Построена архитектура простой свёрточной нейронной сети для классификации изображений.


Были проведены эксперименты по распознаванию изображений с такими популярными нейронными сетями, как VGG16 и ResNet 50. Обе нейронные сети показали хорошие результаты. Однако ResNet 50 переобучилась из-за того, что в наборе данных присутствовали однотипные изображения для обучения, поскольку в данной нейронной сети больше слоев, позволяющих считывать признаки объектов на изображениях. С обученными моделями был проведен сравнительный анализ по распознаванию изображений, специально подготовленных для этого эксперимента.


Для классификации изображений в настоящее время можно применить множество различных инструментов, каждый из которых направлен на решение определенного спектра задач. В статье проведен краткий обзор библиотек и технологий для классификации изображений. Построена архитектура простой свёрточной нейронной сети для классификации изображений.


Были проведены эксперименты по распознаванию изображений с такими популярными нейронными сетями, как VGG16 и ResNet 50. Обе нейронные сети показали хорошие результаты. Однако ResNet 50 переобучилась из-за того, что в наборе данных присутствовали однотипные изображения для обучения, поскольку в данной нейронной сети больше слоев, позволяющих считывать признаки объектов на изображениях. С обученными моделями был проведен сравнительный анализ по распознаванию изображений, специально подготовленных для этого эксперимента.

Ключевые слова: распознавание изображений, нейронная сеть, сверточная нейронная сеть, классификация изображений, машинное обучение.

Проект NewsAgent for Libraries: Персонифицированная служба оперативного информационного обеспечения

Р. Йетс
Аннотация: There are three main ways of obtaining information: searching, browsing and alerting. The first two are being widely developed by libraries using the Web, but the last has been somewhat neglected. The NewsAgent for Libraries project was originally funded under the eLib Programme by JISC (Joint Information Systems Committee of the UK higher education funding councils) as a two-year collaborative project started in April 1996.
Several small publishers of library and information science journals worked with network specialists, market evaluators and commercial software developers to design an open, distributed architecture for disseminating information via email and personalised Web pages. Dublin Core metadata was used, enhanced by NewsAgent specific keywords, to map stored user subject profiles against information feeds. Metadata was harvested using software robots to build an Oracle database where both user profiles and document attributes were stored.
Users can join the service via a Web page, to receive information updates by email or as a personalised Web page. Users can select predefined Topics in which they are interested, or create new named ones (stored queries). They can also modify existing Topics. Topics are presented in groups, called Channels.
A major part of the project was an extensive study of the potential end users of the service, before and after a prototype service was created. The project was considered a success, although further development of both software and marketing strategy were needed before a full scale launch could be planned. This is now expected in autumn 1999. In addition to this service, the software is being applied to other services by different organisations, targetted at groups such as small businesses, medical information and environmental information. It is expected that a commercial software package will be available from Fretwell-Downing Informatics as a result of the project.

Электронный архив наблюдательных данных астрофизической обсерватории

О.П. Желенкова, В.В. Витковский, Т.А. Пляскина
Аннотация: Архивная система обсерватории включает в себя хранилище цифровых данных и информационно-поисковую систему (ИПС) с динамическим веб-интерфейсом и http-доступом. На текущий момент в систему включены 16 цифровых коллекций наблюдательных данных (локальных архивов), полученных на разных приборах, работающих или работавших на телескопах обсерватории. Самые ранние данные относятся к концу 1994 года. В настоящее время активно пополняются 6 локальных архивов. Хранилище данных включает область временного хранения, расположенную на файл-сервере БТА, и область постоянного хранения. Область постоянного хранения это - CD/DVD-диски, жесткий диск выделенного архивного сервера и USB-диск большой емкости. Для сохранности данных при аварийных ситуациях и при возникающих дефектах носителей мы обеспечиваем хранение 2 полных копий на CD/DVD?дисках и двух копий архива на винчестере. Одна копия (A0) повторяет оптические диски, другая (A1), несколько по структуре каталогов модифицированная, используется ИПС. Цифровые носители и устройства чтения-записи данных нельзя отнести к устройствам длительного хранения, поэтому при долговременном хранении цифровых данных необходимо обеспечивать перенос информации на новый тип носителей каждые 5-10 лет. Копии архива A0 и A1 поддерживаются и для этой процедуры переписывания. Вариант архивных данных (A1) повторен на USB-диске с добавлением дампа таблиц и программ. Это резервная копия для восстановления информационной системы при аварийной ситуации на сервере. Для обеспечения модернизации ИПС мы поддерживаем две схемы базы данных — тестовую и рабочую. Разработки ведутся на тестовой схеме. При модификациях схемы после проведенного тестирования ИПС переключается на обновленную версию БД. Оригинальная копия A0 и наличие тестовой схемы позволяют выполнять модернизацию ИПС даже на уровне схемы таблиц. В настоящее время ИПС реализована на СУБД PostgreSQL 8.3.7.
Ключевые слова: цифровые коллекции экспериментальных данных, веб-доступ к архивам наблюдений, виртуальная обсерватория, предметно-ориентированные базы данных.

Семантический рекомендательный сервис присвоения кода УДК математическим статьям

Ольга Авенировна Невзорова, Дамир Альбертович Альмухаметов
203-224
Аннотация:

Классификация документов с присвоением кодов-классификаторов является традиционным способом систематизации и поиска документов по определенной тематике. Универсальная десятичная классификация (УДК) лежит в основе систематизации знаний, представленных в библиотеках, базах данных и других хранилищах информации. В России УДК является обязательным реквизитом всей книжной продукции и информации по естественным и техническим наукам. Выбор классификационных кодов связан с анализом структуры дерева классификатора и традиционно выполняется автором научной статьи.


В настоящей работе предложено решение задачи автоматизации подбора классификационного кода УДК для математической статьи на основе специального ресурса – онтологии OntoMathPRO профессиональной математики, разработанной в Казанском федеральном университете. Подходом к решению задачи автоматизации является создание «кодовых карт» для каждого классифицирующего кода в дереве УДК в области математики. Под «кодовой картой» понимается взвешенный набор всех математических именованных сущностей, извлеченных с помощью онтологии OntoMathPRO из коллекции статей с заданным кодом УДК. Создание «кодовых карт» основано на гипотезе о том, что выбор кода УДК обуславливается определённым набором классифицирующих признаков, которые можно представить классами из онтологии OntoMathPRO. Предложенная гипотеза проверена и подтверждена: проверка гипотезы проведена на коллекции математических статей, опубликованных в журнале «Известия ВУЗов. Математика» в течение 1999–2009 гг.

Ключевые слова: Универсальная десятичная классификация, кодовая карт, кодовая карта, онтология OntoMathPRO, математическая статья.

Увеличение робастности нейронных сетей за счет генерации векторных представлений, инвариантных к атрибутам

Марат Рушанович Газизов, Карен Альбертович Григорян
1142-1154
Аннотация:

Робастность модели к незначительным отклонениям в распределении исходных данных является важным критерием во многих задачах. Нейронные сети могут показывать высокую точность (accuracy) на обучающей выборке, но при этом качество на тестовой выборке может сильно падать из-за разного распределения данных, причем ситуация только усугубляется на уровне подгрупп внутри каждой категории.


В данной статье мы показываем, как робастность модели на уровне подгрупп может быть значительно улучшена с помощью подхода, основанного на доменной адаптации векторных представлений. Мы обнаружили, что применение состязательного подхода к ограничению векторных представлений дает существенный прирост метрики точности (accuracy) в сложной подгруппе по сравнению с предыдущими моделями. Метод протестирован на двух независимых наборах данных, точность в сложной подгруппе на наборе данных Waterbirds составляет 90.3 {y : waterbirds;a : landbackground}, а на наборе данных CelebA – 92.22 {y : blondhair;a : male}.

Ключевые слова: робастная классификация, классификация изображений, генеративно-состязатель сети, доменная адаптация.

Развитие цифровой е-Инфраструктуры непрерывного доступа к научным ресурсам: формирование банка спектральных данных ДЗЗ

М.А. Попов, Е.Б. Кудашев, С.П. Ковальчук, С.А. Пикулик, С.А. Станкевич, С.Ю. Марков
Аннотация: При изучении природных и искусственных объектов с помощью спутниковых технологий важную роль играют спектральные данные, которые несут информацию о распределении отражающих/излучающих свойств физических объектов и материалов по длинам волн. Необходимо отметить, что оперативное получение необходимых спектральных данных из названных выше источников обычно является проблемой. В работе описан подход к построению банка спектральных данных с расширенными функциональными возможностями, позволяющими реализовывать не только справочно-поисковые процедуры, но и достаточно широкий круг расчетно-прикладных процедур относительно спектральных данных и их атрибутов. На основе системного анализа предметной области и реляционной модели предложена схема БД, реализованная средствами MS Access. Обоснована организационная структура БСД. Предложена простая схема интеграции БСД в е-Инфраструктуру непрерывного доступа к научным ресурсам ДЗЗ.
Ключевые слова: электронные библиотеки, спутниковые технологии, спектральные данные, цифровая инфраструктура непрерывного доступа, дистанционное зондирование Земли.

Анализ Russian Science Citation Index c bспользованием данных Math-Net.ru

Знаменская Екатерина Александровна, Печников Андрей Анатольевич, Чебуков Дмитрий Евгеньевич
778-795
Аннотация:

С весны 2022 в России ведется создание национальной системы оценки результативности научных исследований и разработок с использованием базы ведущих российских журналов Russian Science Citation Index (RSCI). В статье изложены некоторые результаты анализа нормированного рейтинга RSCI, опубликованного в декабре 2022 года. С применением графа цитирования журналов, построенного по данным Math-Net.Ru на примере тематической группы OECD 101. Mathematics показано, что при наличии большого количества самоцитирований журналов обнаруживается связь между нормированным рейтингом и количеством ссылок, а связь с учетом самоцитирования несколько сильнее, чем без самоцитирования. Анализ распределения журналов по тематическим группам показывает, что использование в качестве критерия единственного признака, такого как OECD, не позволяет сформировать группу как сообщество журналов, имеющее единственную компоненту сильной связности в графе цитирования. Делается вывод о том, что методы исследования графов цитирования журналов являются хорошей основой для сравнительного анализа характеристик журналов и их ранжирования, а значит, могут быть использованы как инструменты для дальнейшего развития и совершенствования рейтингов журналов.

Ключевые слова: рейтинг журналов, Russian Science Citation Index, Math-Net.Ru, граф цитирования журналов, импакт-фактор, степень влиятельности.

Сетевые коммуникации библиотек: тренд современного развития

Юлия Викторовна Маслова
951-962
Аннотация: Сетевые формы взаимодействия набирают обороты в системе социального общества, сегодня их рассматривают в ряду инноваций, приписывая значительное число возможностей и достоинств. В современном информационном обществе, где информация распространяется с огромной скоростью, без сетевого взаимодействия невозможно представить инновационные процессы. Любая организации всегда испытывает дефициты – ресурсные, кадровые, материально-технические. Не являются исключением и библиотеки, поэтому автор статьи полагает, что создание различных форм сетевого взаимодействия позволит существенно повысить деятельность и престиж каждой библиотеки, входящей в сеть.
Ключевые слова: сеть, сетевое взаимодействие, сетевая коммуникация, сетевое сообщество библиотек.

Метод извлечения главных результатов и формул из текстов научных статей на основе больших языковых моделей

Эрик Вадимович Саитов, Ольга Авенировна Невзорова
2009-2037
Аннотация:

Представлен метод извлечения главных результатов и формул из текстов математических научных статей на основе большой языковой модели DeepSeek. Разработанный метод состоит из следующих шагов: формирование базы аннотаций статей, выделение из них формулировок главных результатов, поиск этих результатов в основном тексте, извлечение в найденных фрагментах ключевых формул с переводом в LaTeX.


 Получены оценки построенного решения по метрикам точности, полноты и F-меры. Средние значения F-меры по тестовой коллекции математических статей для основных результатов и связанных с ними формул равны соответственно 0.93459 и 0.9294.


В качестве способа хранения полученных главных результатов и формул предложена система управления базами данных MySQL, приведено описание соответствующей структуры базы данных.

Ключевые слова: большая языковая модель, математическая статья, основная формула, главная формула, формат LaTeX, извлечение формулы, семантический поиск, аннотирование формул, обработка PDF-документов, информационный поиск, искусственный интеллект, наукометрический анализ.

Западно-европейские издания XVI-XVIII вв. в фондах Фундаментальной библиотеки Пермского государственного гуманитарно-педагогического университета

И.А. Бурдинская, А.В. Костицина
Аннотация: Рассмотрены вопросы изучения фонда иностранной литературы в Фундаментальной библиотеке Пермского государственного гуманитарно-педагогического университета (ПГГПУ) и выявления из него западноевропейских изданий XVI – XVIII веков, способы введения их в научный оборот и привлечения студентов и профессорско-преподавательского состава вуза к исследованию редких и ценных экземпляров. Дана краткая характеристика некоторых изданий этого периода, выявленных в процессе работы.
Ключевые слова: библиотеки вузов, библиотечные фонды, редкие книги.

Живые публикации завоевывают популярность

Михаил Михайлович Горбунов-Посадов
819-829
Аннотация:

Живая публикация – новый жанр представления результатов научных исследований, где научная работа размещается в интернете, а затем постоянно развивается и совершенствуется ее автором. Серьезные ошибки и опечатки больше не являются фатальными и не преследуют автора всю оставшуюся жизнь. Читатель живой публикации знает, что автор методично отслеживает и отражает в своем тексте изменения, происходящие в данной отрасли науки. В то же время российский автор, поддерживающий живую публикацию, сейчас безнадежно проигрывает по многим библиометрическим показателям, облюбованным консервативными чиновниками от науки. Живая публикация стимулирует развитие библиографического аппарата. Размещаемая в онлайне библиографическая ссылка вскоре обязана будет содержать такой важный для читателя, обновляемый «на лету» атрибут, как дата последней редакции живой публикации. Следует ожидать, что по мере распространения живой публикации в научном мире забота автора об эволюции своего онлайна станет сродни родительской заботе о развитии ребенка, а интернет на радость читателю обогатится научными трудами, не теряющими своей актуальности с течением времени.

Ключевые слова: научная публикация, динамический контент, версии статьи, дата последнего обновления.

Интеллектуальный поиск сложных объектов в массивах больших данных

Александр Михайлович Гусенков
40-76
Аннотация: Предложен подход к интеллектуальному поиску сложных объектов в различных типах структурно размеченных текстов, который может быть применен для обработки Больших данных (Big Data). Исследуются два вида представления информационных объектов: реляционные базы данных (РБД), которые структурно размечены своими схемами, и полнотекстовые естественнонаучные документы, содержащие математические выражения (формулы). Для таких полнотекстовых документов предлагается дополнительная автоматизированная разметка для организации поиска формул. В обоих случаях источником информации для построения онтологии и, в дальнейшем, организации поиска являются тексты на естественном языке, которые относятся к слабоструктурированным данным. Для РБД это комментарии к наименованиям таблиц и их атрибутов, а для естественнонаучных документов (статей, монографий и т. д.) – текстовое содержимое размеченных документов.
Ключевые слова: большие данные, семантический поиск, слабоструктурированные данные, онтологии, реляционные базы данных, естественнонаучные тексты, разметка математических выражений.

Как эмбеддинги имен сущностей влияют на качество выравнивания сущностей

Даниил Иванович Гусев, Зинаида Владимировна Апанович
52-79
Аннотация:

Алгоритмы установления соответствия между сущностями осуществляют поиск эквивалентных сущностей в разноязычных графах знаний. Данная проблема возникает, как правило, при интеграции разноязычных графов знаний. В настоящее время решение этой проблемы становится весьма актуальным для практического решения проблем импортозамещения, например, чтобы найти информацию о лекарствах, выпускаемых в разных странах под разными названиями, или же решить проблему поиска эквивалентных запчастей.


В настоящее время известно несколько библиотек с открытым кодом, которые объединяют известные алгоритмы выравнивания сущностей, а также тестовые наборы данных для различных языков. В данной работе описан русско-английский набор данных для экспериментов с нескольким популярными алгоритмами выравнивания сущностей. Особое внимание уделено методам генерации векторных представлений для имен сущностей. В частности, рассмотрены комбинации различных методов генерации векторных представлений (эмбеддингов) имен сущностей с известными алгоритмами выравнивания сущностей. Таблицы с результатами экспериментов дополнены визуализациями. 

Ключевые слова: разноязычные графы знаний, идентификация сущностей, cross-lingual entity alignment, knowledge graphs, relational embeddings, name embeddings.

Использование систем поддержки принятия решений в автоматизации процессов принятия решений

Василий Борисович Чечнев
163-183
Аннотация:

Возрастающая сложность принятия решений в современных условиях предопределяет безусловность необходимости автоматизации такого процесса. Одним из ключевых элементов этого процесса являются системы поддержки принятия решений. В настоящей работе рассмотрены теоретические аспекты и практические пути реализации названного процесса. С этой целью автором предложен новый взгляд на понимание сути системы поддержки принятия решений, а также проведен анализ основных атрибутов и функций систем данного типа, в процессе которого установлено, что одним из наиболее перспективных направлений в использовании искусственного интеллекта в данной области являются мультиагентные системы.


Проведенный анализ актуальных систем поддержки принятия решений показал основные конкурентные преимущества, общие слабые стороны, а также важность продолжения разработки научной парадигмы в отношении отечественной интеллектуальной системы поддержки принятия решений.

Ключевые слова: интеллектуальные системы, системы поддержки принятия решений, мультиагентные системы, принятие решений, информационные системы, компьютерное моделирование.

Когнитивная модель управления термоэлементом Пельтье

Максим Владимирович Бобырь, Артем Андреевич Асеев
976-997
Аннотация:

Представлена онтологическая модель системы управления термоэлементом Пельтье. Онтология описывает ее состав, выделяя объекты, процессы преобразования в объектах и атрибуты связей между ними. На основе разработанной онтологической модели спроектирована каскадная система управления, объединяющая ПИД-регулятор, нечетко-цифровой фильтр и экспоненциально усредняющий фильтр, причем ее когнитивное поведение основано на правилах нечеткой логики. Улучшение динамических характеристик переходных процессов системы управления термоэлементом Пельтье достигается за счет применения модели математических и онтологических решений, при этом каскадная система управления обеспечивает снижение амплитуды первой гармоники управляющего сигнала на 12% и сокращает время переходного процесса на 31.9%.

Ключевые слова: онтология, нечеткая логика, ПИД-регулятор, нечетко-цифровой фильтр, экспоненциально усредняющий фильтр.
1 - 25 из 28 результатов 1 2 > >> 
Информация
  • Для читателей
  • Для авторов
  • Для библиотек
Отправить материал
Текущий выпуск
  • Логотип Atom
  • Логотип RSS2
  • Логотип RSS1

Электронные библиотеки

ISSN 1562-5419

Информация

  • О журнале
  • Цели и задачи
  • Тематика
  • Руководство для авторов
  • Отправка материалов
  • Заявление о конфиденциальности
  • Контакты
  • eLIBRARY.RU
  • dblp computer science bibliography

Отправить статью

Авторам нужно зарегистрироваться в журнале перед отправкой материалов, или, если вы уже зарегистрированы, можно просто войти со своей учетной записью и начать процесс отправки, состоящий из пяти шагов.

Отправить материал
Больше информации об этой издательской системе, платформе и рабочем процессе от OJS/PKP.

© 2015-2026 Казанский (Приволжский) федеральный университет; Институт развития информационного общества