Аннотация:
В статье рассматривается база семронов татарского языка как цифровой лингвистический ресурс для объяснительного искусственного интеллекта. Предлагается модель Большой семиотической базы семронов, в которой лексико-грамматические единицы представлены как семроны – потенциальные смыслообразующие единицы с формой, классом, синтаксическими, семантическими и прагматическими характеристиками, валентностями, правилами активации, корпусными подтверждениями, связями с графом знаний и статусами экспертной проверки. Фреймовое представление используется как способ организации записи семрона: базовый фрейм фиксирует потенциальные возможности единицы, а специализированный фрейм сейрона описывает её контекстную реализацию после закрытия одной или нескольких валентностей. Показано, что такая база может выполнять функцию ресурсного слоя Семиотической генеративной распознающей модели, обеспечивая переход от морфемной структуры татарского текста к ситуационной модели, верифицируемой цепочке и объяснению. Компактные примеры записей демонстрируют структуру фрейма, типы слотов и фасетов, принципы верификации и возможные форматы представления данных.