• Main Navigation
  • Main Content
  • Sidebar

Электронные библиотеки

  • Главная
  • О нас
    • О журнале
    • Цели и задачи
    • Тематика
    • Главный редактор
    • Редакция
    • Отправка материалов
    • Заявление об открытом доступе
    • Заявление о конфиденциальности
    • Контакты
  • Текущий выпуск
  • Архивы
  • Регистрация
  • Вход
  • Поиск
Издается с 1998 года
ISSN 1562-5419
16+
Language
  • Русский
  • English

Найти

Расширенные фильтры

Результаты поиска

Применение методов скоринговой оценки кредитных рисков в мониторинге корпоративного заемщика

Ольга Андреевна Тазенкова
689-709
Аннотация:

Предложен метод оценки риска дефолта корпоративного заемщика на этапе мониторинга на основе скоринговой оценки. Приведено доказательство гипотезы в том, что скоринговые методы оценки кредитных рисков возможны к применению не только на этапе первичной оценки потенциального заемщика при принятии решения о кредитовании, но и на этапе его мониторинга при сопровождении сделки. Мониторинг представляет собой периодическую проверку кредитного качества корпоративного заемщика, с кем заключен кредитный договор. Это делается с целью своевременного выявления негативных сигналов, а также своевременного реагирования на угрожающие тенденции в деятельности заемщика.


Некоторые кредитные организации экономят на мониторинге, полагаясь на систему принятия решения, считая ее безупречной. Однако данная экономия может оказаться фатальной ошибкой, так как многое в течение «жизни» предприятия со временем изменяется. Этому способствуют как внешние факторы (политические, экономические), так и внутренние (неверная стратегия развития организации, неспособность оценить собственные кредитные возможности, недобросовестные контрагенты).


Предлагаемый метод представляет собой систему автоматических риск-сигналов, которые прошли проверку на предсказательную способность, исключая ручные процедуры. В предлагаемое решение включены маркеры (риск-сигналы), которые имеют предсказательную способность выше средней, что может привести к дефолту корпоративного заемщика. Дополнительно применена цветовая маркировка – красный, желтый, зеленый, которая позволяет визуализировать критичность выявленного риск-сигнала в зависимости от предсказательной способности – наглядное представление рисков заемщика с целью облегчения интерпретации.


Анализ разработанного метода показал, насколько возможно ускорить процесс проведения мониторинга, что позволит обеспечить оперативность реагирования на выявленные риск-сигналы, а также спрогнозировать вероятное ухудшение кредитного качества заемщика в кредитном или гарантийном портфеле без ущерба для качества оценки риска.

Ключевые слова: моделирование, корпоративный заемщик, мониторинг, дефолт, кредитный риск, риск-карта, скоринг.

Предсказание качества автоматического распознавания речи на основе больших языковых моделей

Антон Вячеславович Полевой
1189-1211
Аннотация:

Предложен подход к прогнозированию показателя качества распознавания речи Word Error Rate (WER) на основе акустических характеристик сигнала и вычисления перплексии языковых моделей. Предлагаемый метод включает в себя создание разнообразных наборов аудиоданных путем применения различных типов акустических искажений к чистым речевым образцам на различных уровнях качества и разборчивости. В отличие от предыдущих работ, извлекается и анализируется полный набор речевых признаков: прогнозирование значения отношения сигнал/шум (signal-to-noise ratio, SNR), нейросетевые метрики качества звука (NISQA и др.), метрики уверенности модели распознавания речи, а также перплексия текста гипотезы ASR по языковой модели в качестве дополнительного признака для обучения единой модели прогнозирования WER.


Проведены эксперименты с использованием современных архитектур распознавания речи для демонстрации эффективности предлагаемого метода в прогнозировании WER в различных акустических условиях. Показано, что включение перплексии существенно повышает качество прогноза WER, в частности для данных, где акустические признаки слабо коррелируют с ошибками распознавания. Результаты применимы для автоматической оценки ожидаемого качества распознавания речи и фильтрации аудиовходов.

Ключевые слова: прогнозирование WER, акустическая деградация при распознавании речи, перплексия, уверенность систем автоматического распознавания речи.

Метод предварительной оценки ответов обучающихся на основе векторной модели документов

Чулпан Бакиевна Миннегалиева, Гульшат Альфисовна Сабитова, Алмаз Маратович Гаялиев
324-339
Аннотация:

Рассмотрено применение векторных моделей для предварительного анализа ответов студентов, сформулированных в свободной форме. Векторные представления слов и документов получены при помощи моделей word2vec, doc2vec, BERT. Сходство ответа, данного обучающимся, и корректного ответа определялось с использованием косинусной меры. Выявлено, что векторные модели позволяют определить явно неверные ответы с достаточной точностью. Для ответов, которые близки по формулировке, предлагается провести дополнительный этап проверки. При помощи word2vec выполнена двоичная классификация ответов на определенные вопросы, приведены оценки точности, полноты, F1-меры.

Ключевые слова: векторная модель, word2vec, doc2vec, BERT, косинусное сходство, векторное представление.

Автоматическое распознавание речи: факторы снижения точности при работе с региональным вариантом русского языка (на материале Дагестана)

Артем Игоревич Кацнельсон, Ольга Николаевна Ляшевская
2058-2079
Аннотация:

Работа посвящена сравнительному анализу качества автоматического распознавания стандартного русского языка и его дагестанского региолекта (дагестанского русского) – контактного идиома, формирующегося в условиях многоязычия Дагестана. Десять конфигураций ASR-систем (без дообучения), представляющих три архитектурных подхода (Conformer+RNNT, Conformer+CTC, Encoder-Decoder Transformer), протестированы на корпусах стандартного русского (GOLOS, RuDevices, примерно 20 и 90 тыс. высказываний) и дагестанского русского (DaGRuS, примерно 40 тыс. высказываний). Все модели демонстрируют падение метрики WER на 33–50% при переходе к дагестанскому русскому, что указывает на проблему сильного доменного сдвига. Анализ структуры ошибок выявил три основных механизма, вызывающих снижение WER: это русификация – систематическая замена дагестанских форм фонетически близкими стандартными русскими словами; удаление дискурсивных маркеров и OOV-лексики (этнонимов, топонимов); галлюцинации генеративных моделей на непонятных фрагментах. Установлено, что сквозные архитектуры-архитектуры деградируют слабее каскадных (33–35% против 40–42%), однако ни одна из моделей не достигает приемлемого качества (минимум WER около 43%). Сформулированы рекомендации для проектирования ASR-систем, устойчивых к региональной вариативности русского языка.


 

Ключевые слова: автоматическое распознавание речи, ASR, дагестанский региолект русского языка, региолект, региональные варианты речи, WER, языковая вариативность, доменный сдвиг, Conformer, Whisper, GigaAM, галлюцинации.

Автоматизированное оценивание коротких ответов обучающихся с использованием языковых моделей

Чулпан Бакиевна Миннегалиева, Ильнур Илхамович Кашапов, Ольга Дмитриевна Морозова
278-293
Аннотация:

Методы проверки ответов обучающихся с использованием языковых моделей в настоящее время исследуются разными специалистами. Результаты автоматизированного оценивания зависят от предметной области и особенностей учебной дисциплины. В работе проанализированы ответы студентов, полученные в ходе изучения курса «Компьютерная графика и дизайн». При помощи языковых моделей определены векторы документов. Предложен метод оценивания ответов через нахождение косинусного сходства полученных векторов и уточнение оценок проверкой ключевых слов. Результаты могут использоваться при предварительной проверке ответов студентов и являются базой для дальнейших исследований. 

Ключевые слова: языковая модель, контроль знаний, обработка текста, ключевое слово ответа, автоматизированная оценка ответов обучающихся, косинусное сходство, векторное представление документа, BERT, word2vec, открытый вопрос.

Технологии искусственного интеллекта для анализа ограничений контента в интернете

Мурад Джериби, Ху Хао, Андрей Михайлович Сухов
1924-1958
Аннотация:

Предложен новый подход к анализу ограничений контента в Интернете. В основу положен принцип доступности альтернативной точки зрения в выдаче поисковых систем и больших языковых моделей. Методика подсчета предполагает составление с помощью технологий искусственного интеллекта (ИИ) списка из 11 вопросов, ответы на которые предполагают полярно противоположные мнения в зависимости от страны. Эти ответы оцениваются технологиями ИИ в ходе сравнения с правительственной точкой зрения. Применяемая методология анализа оценивает семантическую близость текстов с использованием архитектуры нейронных сетей. В выдаче поисковых систем рассчитывается количество ответов на эти вопросы с преобладанием проправительственной точки зрения и доля ответов, в которых подробно изложена альтернативная точка зрения. Различие между этими показателями предложено рассматривать как индекс интернет-цензуры. Так как интернет-поиск все чаще производится с использованием чат-ботов наиболее известных больших языковых моделей, оценка уровня ограничений приведена и для этих моделей. Сравнение показало, что соответствие ответов национальной поисковой системы Baidu в Китае наиболее близко правительственной точке зрения, а уровень ограничений в США выше, чем в России. Эффективность ограничений контента интернета в США объясняется иным механизмом, при котором материалам с альтернативным мнением ограничивают доступ к популярным информационным площадкам. Ограничения в чат-ботах намного сильнее, чем в выдачах интернет-поисковиков.

Ключевые слова: механизмы ограничений контента в интернет, методика измерения ограничений на основе технологий ИИ, сравнительный анализ природы ограничений в США, России и Китае, ограничения контента в чат-ботах.

Варианты видеолекций

116-156
Аннотация:

Статья посвящена типологии основных вариантов видеолекций (https://vimeo.com/showcase/6184718), отличающихся дидактической ценностью и трудоёмкостью создания. Для каждого варианта видеолекций определены ключевые условия эффективного формирования и использования. Особое внимание уделено вопросам оптимизации аппаратного обеспечения для создания различных вариантов видеолекций в условиях очного и дистанционного обучения.


В качестве базового варианта рассматривается видеозапись демонстрации презентации PowerPoint с речевыми и графическими комментариями слайдов. Стандартный профильный вариант — отснятый слева экран (доска) с лектором в профиль — рекомендуется использовать при дефиците места в аудитории. При наличии видеокамеры с оптикой, обеспечивающей сохранение детализации изображений наглядных материалов, предпочтительным вариантом видеолекции является стандартный фронтальный, отснятый из дальнего конца аудитории. Дидактически оптимизированный монтаж видеолекции позволяет комбинировать высококачественную запись наглядных материалов базового варианта с любыми видеозаписями действий преподавателя. Интегративные варианты видеолекций создаются посредством оверлейной вставки видеозаписи действий преподавателя поверх специально предназначенного инвариантного места в дизайне слайдов базового варианта видеолекции. Предложены варианты адаптации дизайна презентаций PowerPoint для формирования базового и интегративного варианта видеолекций. Наивысшее соотношение «дидактическое качество/ресурсоёмкость» достигается при создании интегративных видеолекций непосредственно в процессе очных и дистанционных занятий.

Ключевые слова: видеолекция, интегративная видеолекция, создание учебных видео, дистанционное обучение, очное обучение, рабочая среда, Microsoft PowerPoint , HyperCam.

Организация дистанционного лабораторного практикума в инженерном образовании на базе веб-платформы

Владислав Витальевич Шаронов, Тимирхан Нурбулатович Абсатаров , Михаил Владимирович Лукошевивский , Сергей Дмитриевич Федорович
1843-1857
Аннотация:

Представлена отечественная веб-платформа ООО «Лабораториум» для проведения лабораторных работ на реальном экспериментальном оборудовании в дистанционном формате. Доступ к стенду реализован через стандартный браузер в рамках управляемых сеансов: обучающийся наблюдает за состоянием установки по видеопотоку, выполняет управляющие воздействия и автоматически формирует электронный протокол результатов. Преподаватель получает набор инструментов для назначения работ, планирования общей очереди доступа и проверки результатов на основе детальных журналов сеансов. Рассмотрены типовые сценарии использования платформы – как внутри отдельной образовательной организации, так и в сетевом межвузовском взаимодействии. Платформа проходит апробацию на кафедре общей физики и ядерного синтеза НИУ «МЭИ»; предварительные результаты оценены как положительные.

Ключевые слова: дистанционные лабораторные работы, инженерное образование, удаленный доступ к оборудованию, лабораторный стенд, вебплатформа, видеопоток, электронный протокол, межвузовское взаимодействие.

Mixed methods study of middle school mathematics teachers’ content knowledge in usa and russia using sequential nested design

Мурат Аширович Чошанов
255-286
Аннотация: The sequential nested mixed methods study focused on comparative analysis of middle school mathematics teachers’ content knowledge in two countries. The study consisted of two stages: (1) quantitative study of teacher content knowledge; (2) qualitative study of teacher topic-specific content knowledge. The initial sample for the first stage included lower secondary mathematics teachers from the U.S. (grades 6–9, N=102) and Russia (grades 5–9, N=97). The Teacher Content Knowledge Survey (TCKS) was applied to assess teacher content knowledge based on the cognitive domains of Knowing, Applying, and Reasoning, as well as addressing the lower secondary mathematics topics of Number, Algebra, Geometry, Data and Chance. The second stage – an interpretive cross-case study – aimed at the examination of the U.S. and Russian teachers’ topic-specific knowledge on the division of fractions. For the second stage, N=16 teachers (8 – from the U.S., and 8 – from Russia) were selected for the study using non-probability purposive sampling technique based on teachers’ scores on the TCKS. Teachers were interviewed on the topic of fraction division using questions addressing their content and pedagogical content knowledge. The study revealed that there are explicit similarities and differences in teachers’ content knowledge as well as its cognitive types. The study results may inform the field on priorities placed on lower secondary mathematics teachers’ knowledge in the USA and Russia. It also suggests close comparison and learning about issues related to teacher knowledge in both countries with a potential focus on re-examining practices in teacher preparation and professional development.
Ключевые слова: cross-national comparison, teacher knowledge, topic-specific content knowledge, lower secondary school mathematics.

Коммуникативная предвзятость ASR при распознавании атипичной речи на русском языке

Анастасия Владимировна Колмогорова, Екатерина Валерьевна Явшиц, Милана Святославна Майорова, Софья Владимировна Дмитриева
2134-2157
Аннотация:

Статья посвящена проблеме коммуникативной предвзятости систем автоматического распознавания речи при работе с атипичной речью на русском языке. Актуальность исследования обусловлена активным внедрением технологий искусственного интеллекта в социальную сферу и государственное управление в России, что предполагает обеспечение их доступности для различных категорий граждан, включая людей с речевыми нарушениями. Введено понятие коммуникативной предвзятости ASR-моделей как свойства системы в условиях неопределенности (атипичная речь, шум, паузы) принимать решения о заполнении смысловых и акустических лакун на основе собственной обучающей выборки. В эмпирической базы исследования выбран корпус RuAphasiaBank, включающий записи речи пациентов с различными типами афазии (моторной, сенсорной, семантической, сенсомоторной) разной степени тяжести, а также нейротипичных информантов. Для сравнительного анализа были отобраны шесть ASR-моделей, работающих с русским языком: две открытые (GigaAM, T-One) и четыре коммерческие (Yandex SpeechKit, Any2Text, Charla, Speech2Text). Качество распознавания оценено с использованием метрик WER и CER, а также с помощью  анализа соотношения вставок, удалений и замен на уровне слов и символов. Результаты показали, что модели реализуют различные стратегии при столкновении с атипичной речью: «паническое укорачивание» (GigaAM, Yandex SpeechKit), «лексическое сохранение» в ущерб точности (T-One) и «стабильная» стратегия сбалансированных ошибок (Any2Text, Speech2Text, Charla). Лингвистический анализ выявил, что каждая модель порождает специфический искаженный коммуникативный стиль: от разговорной диалогической речи до стиля, ассоциируемого с когнитивными нарушениями или употреблением молодежного сленга. На основе полученных данных моделируются потенциальные риски для социального самочувствия и правовой защищенности пациентов с афазией при использовании голосовых помощников в государственных учреждениях.

Ключевые слова: речевые технологии, речевая база данных, автоматическое распознавание речи, атипичная речь, афазия, коммуникативная предвзятость, голосовые ассистенты, ассистивные технологии, инклюзивность.

Нормализация текста, распознанного при помощи технологии оптического распознавания символов, с использованием легковесных LLM

Владислав Константинович Вершинин, Иван Владимирович Ходненко, Сергей Владимирович Иванов
1036-1056
Аннотация:

Несмотря на значительный прогресс, технологии оптического распознавания символов (OCR) для исторических газет по-прежнему допускают 5–10% ошибок на уровне символов. В работе представлена полностью автоматизированная система нормализации пост-OCR, объединяющая легкие языковые модели (LLM) объемом 7–8 млрд параметров, обученные по инструкциям и квантизованные до 4 бит (INT4), с небольшим набором регулярных выражений. На наборе данных BLN600 (600 страниц британских газет XIX в.) лучшая модель YandexGPT-5-Instruct Q4 снижает Character Error Rate (CER) с 8.4% до 4.0% (–52.5%) и Word Error Rate (WER) с 20.2% до 6.5% (–67.8%), повышая при этом семантическое сходство до 0.962. Система работает на потребительском оборудовании (RTX-4060 Ti, 8 ГБ VRAM) со скоростью около 35 секунд на страницу и не требует дополнительного обучения или параллельных данных. Полученные результаты показывают, что компактные INT4-LLM являются практичной альтернативой крупным моделям для постобработки OCR исторических документов.

Ключевые слова: оптическое распознавание символов, пост-OCR-коррекция, исторические газеты, большие языковые модели, квантизация, INT4, конвейер нормализации, ошибка на уровне символов, семантическое сходство, регулярные выражения, YandexGPT-5, легкие модели, обработка естественного языка, цифровые гуманитарные науки, оцифровка документов.

Процессный подход и построение базы данных по управлению непрофильными активами кредитной организации

Марат Хайдарович Шакиров
710-753
Аннотация:

Проведен анализ развития интеллектуальных систем в кредитных организациях (далее – Банках).


Предложен метод выстраивания сквозного управленческого учета в подразделении кредитной организации, специализирующегося на работе с непрофильными активами. На базе процессного подхода предложен алгоритм внедрения в работу подразделения базы данных для формирования ключевых индикаторов производительности и контроля.


Описаны ключевые этапы работы подразделения, атрибутный состав сущностей (множества), поступающих, обогащаемых и передаваемых на каждом этапе работы подразделения. Методом моделирования процесса выстроены ролевая модель, права доступа и редактирования для сотрудников. Предложены источники данных (справочники) для оптимизации и унификации процесса наполнения базы данных (кортежа). Предложен способ обращения к базе данных в надстройке Power Query Microsoft Excel, которая позволяет собирать данные из файлов всех основных типов данных, обрабатывать и дорабатывать полученные данные. На языке Python на основе данных построены математические и финансовые модели анализа данных (логистическая регрессия, дерево решений и метод дисконтированных денежных потоков) с целью прогнозирования расходов, сроков экспозиции активов и принятия решения об оптимальной стоимости постановки имущества на баланс Банка и цены реализации. На основе библиотек (matpotlib, seaborn, plotly) предложены варианты визуализации данных для менеджмента. На примере подразделения Банка описаны положительные эффекты и возможности, которые открываются перед менеджментом разного уровня в решении повседневных задач и планирования деятельности подразделения. Предложено техническое задание по разработке витрины реализации непрофильных активов на сайте Банка как среды накопления внешних данных для принятия гибких менеджерских решений.

Ключевые слова: непрофильный актив, процессный подход, база данных, Power Query, визуализация данных, математические и финансовые методы анализа данных, регрессионный анализ, дерево решений, метод дисконтированных денежных потоков.

Где находятся лучшие признаки? Послойный анализ слоев трансформера для эффективной классификации эндоскопических изображений

Ахмад Таха, Рустам А. Лукманов
1207-1229
Аннотация:

В поисках путей развития медицинского искусственного интеллекта показано, что предварительно обученный Vision Transformer с линейным классификатором может достигать высокой и конкурентоспособной производительности в классификации эндоскопических изображений. Представлен систематический послойный анализ, который выявляет источник наиболее важных признаков, оспаривая общепринятую эвристику использования только последнего слоя. Установлен отчетливый феномен «пика перед концом», когда поздне-промежуточный слой предлагает более обобщаемое представление для последующей медицинской задачи. На стандартных наборах данных Kvasir и HyperKvasir предложенный подход с малым количеством параметров не только получить достаточно высокую точность, но и значительно сокращает вычислительные затраты. Полученные работы могут быть рекомендованы в качестве практического руководства по эффективному использованию признаков общих базовых моделей в клинических условиях.

Ключевые слова: классификация эндоскопических изображений, замороженный кодировщик, извлечение признаков, послойный анализ, визуальный трансформер (ViT), перенос обучения, самоконтролируемое обучение (SSL), медицинский искусственный интеллект.

Семантический анализ документов в системе управления цифровыми научными коллекциями

Шамиль Махмутович Хайдаров
61-85
Аннотация: Предложены методы семантического анализа документов в системе управления цифровыми научными коллекциями, в том числе электронными научными журналами. Рассмотрены методы обработки документов, содержащих математические формулы, а также способы конвертации этих документов из формата OpenXML в формат TeX. Разработан алгоритм поиска по формулам в коллекциях математических документов, хранящихся в формате OpenXML. Алгоритм реализован в виде онлайн-сервиса на платформе science.tatarstan.
Ключевые слова: семантический анализ, издательские системы.

Автоматическое добавление SEO-метаданных в новостные статьи с использованием QWEN-coder

Хамза Салем, Александр Сергеевич Тощев
287-303
Аннотация:

Обобщен ранее разработанный конвейер обогащения новостных статей структурированными метаданными и представлена его обновленная конфигурация, в которой GPT-3 (Generative Pre-trained Transformer 3) – языковая модель от компании OpenAI – заменен на открытую модель Qwen-Coder. Новая версия, как и ранее, использует набор из 400 страниц, отобранных через Google News, и остается совместимой с Google Rich Results Test. Эксперименты показали, что качество, сопоставимое с GPT-3, достижимо при локальном запуске на типовом офисном настольном компьютере (CPU, без GPU). Установлено, что замена, указанная выше, снижает зависимость от платных облачных сервисов и обеспечивает более высокую производительность по сравнению с GPT-версией; дана оценка сходства результатов обогащения для Qwen-Coder относительно базовой реализации на GPT-3. Предложенные инструменты снижают порог внедрения семантической разметки и расширяют ее практическое применение, в том числе в цифровой журналистике.

Ключевые слова: семантическая паутина, майнинг шаблонов, Qwen-Coder, новостные веб-страницы, читабельность, структурированные данные.

Применение моделей мышления в интеллектуальных вопросно-ответных системах

Александр Сергеевич Тощев
222-230
Аннотация: Описана эволюция моделей мышления в рамках решения задачи построения интеллектуальной вопросно-ответной системы для автоматизации обработки запросов пользователей на естественном языке, начиная от простой модели на основе деревьев решений и заканчивая полноценной моделью мышления, основанной на модели мышления человека Марвина Мински. Каждая модель разработана и протестирована. Приведены результаты экспериментов и сделаны выводы о состоятельности каждой из моделей.
Ключевые слова: искусственный интеллект, машинное обучение, системный анализ, машинное мышление, обработка естественного языка, деревья решений.

Вычислительная модель эмоций в интеллектуальных информационных системах

Максим Олегович Таланов, Александр Сергеевич Тощев
231-241
Аннотация: Проведено исследование эмоций в различных аспектах: философском, психологическом и нейрофизиологическом; с их учетом описана созданная когнитив-ная архитектура. На основе «куба эмоций» Левхайма, «колеса эмоций» Плутчика, «теории аффектов» Томкинса и модели мышления Мински охарактеризовано использование эмоций как факторов влияния на вычислительный процесс компьютера. Указаны также возможности использования эмоций в интеллектуальных вопросно-ответных системах.
Ключевые слова: искусственный интеллект, виртуальный помощник, социальный агент, эмоции, модели мышления, вычислительные эмоции.

Модель лингвистического графа знаний «Turklang» как база для создания инструментов обучения тюркским языкам

Айрат Рафизович Гатиатуллин, Николай Аркадиевич Прокопьев
251-265
Аннотация:

Описаны элементы модели лингвистического графа знаний «Turklang», разработанного в Институте прикладной семиотики АН РТ и используемого в качестве базы для создания ряда лингвистических ресурсов и инструментов: портал «Тюркская морфема», электронный корпус татарского языка «Туган Тел», лингвистические процессоры.


Для создания образовательной среды необходимы предметно-ориентированные графы знаний, для получения которых не применимы методы создания общих и открытых графов. В работе описаны лингвистические графы знаний, которые отображают, с одной стороны, потенциальные возможности тюркских языков, с другой стороны, примеры реального использования в текстах. Особенность этих графов знаний заключается в том, что они содержат лингвистические единицы разных языковых уровней, а также семантические универсалии, соответствующие значениям этих лингвистических единиц, которые встроены в единую модель лингвистического графа знаний. Структура такого графа знаний позволяет формировать учебные курсы, строить индивидуальную образовательную траекторию, а также создавать задания и средства автоматизированной проверки в рамках контроля знаний при обучении тюркским языкам. Это дает возможность разрабатывать впоследствии, на основе этих графов, программы обучения с учетом структурно-функциональных особенностей тюркских языков, а также способствует реализации индивидуальных целей обучающихся.

Ключевые слова: граф знаний, база знаний, лингвистический ресурс, лингвистическая единица, малоресурсные языки, тюркские языки, веб-портал, электронное образование, контроль знаний, автоматизированная оценка ответа.

Рекомендательная система поиска экспертов для проведения научного рецензирования в математическом журнале

708-732
Аннотация: Предложен подход к организации экспертной оценки научного документа, представленного для публикации в математический журнал. Ограничение предметной области связано с использованием системы математической классификации Mathematical Sciences Classification System – MSC. Представлена рекомендательная система, позволяющая сформировать список возможных экспертов для проведения процедуры научного рецензирования математической статьи. Эта рекомендательная система использует коды MSC2020, изначально представленные автором статьи. Если в статье указаны коды MSC2000 или MSC2010, производится их автоматическое преобразование в коды MSC2020. Для каждого эксперта в системе поддерживается персональный профиль, который содержит набор кодов MSC2020, дополненный числовыми характеристиками, – весами, вычисленными для каждого кода в соответствии с системой учета компетенций, предпочтений или отказов от участия в процедуре рецензирования, сформированных в процессе предыдущей работы в качестве эксперта. Этот набор автоматически редактируется в случае включения эксперта в список возможных рецензентов – повышаются или уменьшаются веса нескольких кодов, а также добавляются новые коды. Рекомендательная система реализована в виде встроенного инструмента (плагина) платформы Open Journal Systems (OJS). Разработанный метод апробирован в информационной системе научного журнала Lobachevskii Journal of Mathematics (https://ljm.kpfu.ru).
Ключевые слова: информационная система научного журнала, Open Journal Systems, рабочий процесс рецензирования, автоматический выбор рецензентов, Mathematics Subject Classification 2010, Lobachevskii Journal of Mathematics.

Поиск слов в рукописном тексте на основе штриховой сегментации

Иван Дмитриевич Морозов, Леонид Моисеевич Местецкий
1435-1453
Аннотация:

Рукописные архивные документы составляют фундаментальную часть культурного наследия человечества, однако их анализ остается трудоемкой задачей для профессиональных исследователей-историков, филологов и лингвистов. В отличие от коммерческих приложений систем OCR (Optical Character Recognition, оптического распознавания символов), работа с историческими рукописями требует принципиально иного подхода из-за чрезвычайного многообразия почерков, наличия правок и деградации материалов.


Предложен метод поиска в рукописных текстах, основанный на штриховой сегментации. Вместо полного распознавания текста, часто недостижимого для исторических документов, метод позволяет эффективно отвечать на поисковые запросы исследователей. Ключевая идея заключается в декомпозиции текста на элементарные штрихи, формировании семантических векторных представлений с помощью контрастного обучения, последующей кластеризации и классификации для создания адаптивного словаря почерка.


Экспериментально показано, что поиск сравнением кортежей редуцированных последовательностей наиболее информативных штрихов по расстоянию Левенштейна обеспечивает достаточное качество для рассматриваемой задачи. Метод демонстрирует устойчивость к индивидуальным особенностям почерка и вариациям написания, что особенно важно для работы с авторскими архивами и историческими документами.


Предложенный подход открывает новые возможности для ускорения научных исследований в гуманитарной сфере, позволяя сократить время поиска нужной информации с недель до минут, что качественно меняет возможности исследовательской работы с большими архивами рукописных документов.

Ключевые слова: рукописный текст, поиск, штриховый анализ, сегментация, векторное представление, контрастное обучение, кластеризация.

Компетентностный подход в обучении высшей математике студентов-бакалавров направления подготовки 13.03.02 – «Электроэнергетика и электротехника» в нефтегазовом вузе

Татьяна Анатольевна Бродская
542-546
Аннотация: Целью математической подготовки бакалавров технических специальностей в рамках компетентностного подхода является формирование математической компетентности специалиста, которая выражается в способности выпускников применять математические методы в профессиональной деятельности. Компетенции приобретаются студентами в процессе освоения содержания образования, зафиксированного в образовательных стандартах и учебных программах дисциплин. Используя новые методы и формы организации учебного процесса, применяя новые средства обучения, можно сформировать компетенции на лекционных и практических занятиях по высшей математике.
Ключевые слова: компетентностный подход, математическая подготовка в нефтегазовом вузе.

Издания XIX-XX века о телеграфе (по материалам электронных библиотек)

Юрий Евгеньевич Поляк
1157-1183
Аннотация:

В позапрошлом столетии произошли революционные изменения в передаче информации. Для функционирования оптического телеграфа, появившегося в конце XVIII века, были необходимы громоздкие башни для прямой видимости сигналов семафора. Сто лет спустя протяжённость телеграфных линий составляла сотни тысяч километров; на рубеже веков начались первые опыты применения беспроводного телеграфа. Информация об этом отражена в многочисленных брошюрах, книгах, периодических изданиях того времени. Ещё через сто лет многие из этих материалов стали общедоступными благодаря развитию интернета и электронных библиотек; они интенсивно сканируются и выкладываются в Сеть. Взрывной рост количества электронных библиотек и их информационного наполнения сделал возможным появление данной работы. Её цель – проследить эволюцию технологий и процессов передачи информации, отражённую в литературе, с помощью самых разнообразных электронных библиотек – от грандиозных проектов Библиотеки Конгресса и Google Books с их миллионами оцифрованных книг до скромных частных собраний, посвящённых локальным темам. Использованы материалы более 20 электронных библиотек.

Ключевые слова: электронные библиотеки, история техники, оптический телеграф, электромагнитный телеграф, трансатлантический кабель, радио.

Интеллектуальный ассистент для проектирования экранов радиационной защиты

Людмила Анатольевна Зинченко, Андрей Михайлович Чернецов, Вадим Вячеславович Казаков, Евгений Сергеевич Поляков, Елена Николаевна Комкова, Валентина Михайловна Киселева
739-750
Аннотация:

Рассмотрена актуальная задача разработки интеллектуального агента для моделирования характеристик экранов защиты электронной аппаратуры, который позволит упростить анализ различных проектных решений и обеспечить поддержку принятия решения инженером-проектировщиком. Разработан интеллектуальный агент, позволяющий автоматизировать процесс подготовки описания альтернативного проектного решения для последующего моделирования с использованием программного пакета Geant4. Интеграция программного модуля в вычислительные платформы даст возможность усовершенствовать работу инженера-проектировщика за счет сокращения рутинных ручных операций, минимизировать человеческие ошибки и гарантировать воспроизводимость результатов.

Ключевые слова: интеллектуальный ассистент, агент, генеративные технологии, автоматизация, радиация, тяжелые заряженные частицы, моделирование, Geant4.

Современные космические технологии изучения Земли как системы

Игорь Николаевич Гансвинд
39-49
Аннотация:

Систематические спутниковые наблюдения позволили проследить изменения на Земле на протяжении десятилетий. Низкие околополярные орбиты служат идеальной платформой для измерений параметров гравитационного и магнитного полей. Переход к определению параметров движения путем непрерывного GPS-слежения, межспутниковые измерения и градиентометрия обеспечили получение данных для анализа гравитационного поля с привлечением океанской топографии. Группировка спутников позволяет проводить измерения магнитного поля одновременно в разных точках пространства. Накопленный объем спутниковых данных нуждается в междисциплинарном структурировании и усвоении в моделях.

Ключевые слова: GPS-слежение за низкоорбитальными спутниками, межспутниковые измерения, спутниковая гравитационная градиометрия, океанская топография геопотенциальные модели, спутниковая «магнитная градиометрия», мониторинг солнечно-земных связей.

Рефал-сервер

Александр Альфредович Гусев
697-707
Аннотация: Работа посвящена описанию проекта обновления и распространения языка программирования Рефал (далее – просто Рефал), созданного в СССР в 1960-х годах В.Ф. Турчиным. Язык изначально предназначался для различных логических преобразований, прежде всего, текстового материала и ориентирован на использование непрограммистами. На практике сфера применения оказалась шире: машинный перевод, оптимизация и компиляция программ, доказательство теорем, моделирование сложных электронных схем, решение ряда задач искусственного интеллекта. Язык сейчас имеет достаточное количество последователей, главным образом, в научных кругах.Задачей описываемого проекта является создание продукта, позволяющего использовать Рефал в современных массовых приложениях и расширить круг его потенциальных пользователей до всего интернета. Был проведён опрос сообщества пользователей и разработчиков Рефала с целью получения представления о текущем состоянии дел, актуальных реализациях и путях развития языка. Были рассмотрены возможные средства реализации проекта. Информации о ведущихся аналогичных разработках получено не было.
Ключевые слова: Рефал, сервер, обработка текстов, xml, json, искусственный интеллект, метавычисления.
1 - 25 из 50 результатов 1 2 > >> 
Информация
  • Для читателей
  • Для авторов
  • Для библиотек
Отправить материал
Текущий выпуск
  • Логотип Atom
  • Логотип RSS2
  • Логотип RSS1

Электронные библиотеки

ISSN 1562-5419

Информация

  • О журнале
  • Цели и задачи
  • Тематика
  • Руководство для авторов
  • Отправка материалов
  • Заявление о конфиденциальности
  • Контакты
  • eLIBRARY.RU
  • dblp computer science bibliography

Отправить статью

Авторам нужно зарегистрироваться в журнале перед отправкой материалов, или, если вы уже зарегистрированы, можно просто войти со своей учетной записью и начать процесс отправки, состоящий из пяти шагов.

Отправить материал
Больше информации об этой издательской системе, платформе и рабочем процессе от OJS/PKP.

© 2015-2026 Казанский (Приволжский) федеральный университет; Институт развития информационного общества