Исследователи Лаборатории языковой конвергенции НИУ ВШЭ в Санкт-Петербурге разработали эмоциональный словарь для искусственного интеллекта, который называется «мультимодальный эмоциональный датасет».
Данный словарь для ИИ включает в себя различные фрагменты видео, которые при обработке дадут возможность программам более точно интерпретировать человеческие эмоции. Искусственный интеллект будет применять звук, текст и визуальные данные для этих целей.
«То, что раньше выполнял лингвист на основе словаря, теперь реализуют вычислительные модели, но их словарь должен быть структурирован иначе. Вместо пары “слово — толкование” используется пара “текстовый фрагмент — эмоциональная метка”, — пояснила заведующая Лабораторией языковой конвергенции Анастасия Колмогорова.
Созданный датасет — это не просто набор данных, подчеркивают в НИУ ВШЭ. Он решает несколько ключевых задач: служит надежным источником для обучения новых моделей, становится инструментом для оценки имеющихся систем и выступает в роли «золотого стандарта» для исследований в области эмоциональной речи на русском языке.
Фото: hi-tech.mail.ru

