Ученые СПбГУ улучшили способность нейросети вести диалог
Лингвисты Санкт-Петербургского госуниверситета создали уникальную интонационную модель для нейросетей, которая делает синтезированную речь максимально естественной. Разработка решает главную проблему современных голосовых помощников — «роботизированное» звучание и отсутствие эмоций.
Основой для обучения ИИ стала классификация, созданная фонетистами СПбГУ. Нейросеть научили учитывать мелодику голоса, темп, акценты и смысловые оттенки, что позволяет ей безошибочно передавать интонацию вопроса, просьбы или приказа. Эксперименты с участием добровольцев показали, что люди воспринимают синтезированную речь как живую и легко считывают её подтекст.
Новая технология поможет усовершенствовать голосовых ассистентов и антропоморфных роботов. В планах учёных — добавить искусственному интеллекту ещё больше эмоциональных и стилистических нюансов.
ИЗВЕСТИЯ/Полина Фиолет








































