Ученые СПбГУ улучшили способность нейросети вести диалог

7 авг, 04:08
Сабина Идиатулина
Лингвисты Санкт‑Петербургского государственного университета усовершенствовали нейросеть, внедрив в нее интонационную модель.
Фото: ИЗВЕСТИЯ/Полина Фиолет

Лингвисты Санкт-Петербургского госуниверситета создали уникальную интонационную модель для нейросетей, которая делает синтезированную речь максимально естественной. Разработка решает главную проблему современных голосовых помощников — «роботизированное» звучание и отсутствие эмоций.

Основой для обучения ИИ стала классификация, созданная фонетистами СПбГУ. Нейросеть научили учитывать мелодику голоса, темп, акценты и смысловые оттенки, что позволяет ей безошибочно передавать интонацию вопроса, просьбы или приказа. Эксперименты с участием добровольцев показали, что люди воспринимают синтезированную речь как живую и легко считывают её подтекст.

Новая технология поможет усовершенствовать голосовых ассистентов и антропоморфных роботов. В планах учёных — добавить искусственному интеллекту ещё больше эмоциональных и стилистических нюансов.

Ранее 78.ru писал, что петербуржцам назвали медианную зарплату в профессиях, где требуются навыки работы с ИИ.