Boom metrics
НовостиОбщество14 июля 2026 8:26

ИИ в России сможет точнее разбирать звонки, подкасты и голосовые сообщения

ГигаЧат научился слышать эмоции в голосе
Фото: архив КП

Фото: архив КП

Сбер обновил ИИ-помощника ГигаЧат. Новая модель GigaChat Audio теперь работает с аудио напрямую — без предварительного перевода речи в текст. Она понимает не только слова, но и интонацию: может определить, с какой эмоцией говорит человек, и ответить уместнее.

«Голос — самый естественный способ общения с технологией, но и самый требовательный», — отметил старший вице-президент Сбербанка Антон Фролов. По его словам, ошибка в распознавании речи или эмоции быстро разрушает доверие к ассистенту.

ГигаЧат теперь может обрабатывать записи длиной до трёх часов. Пользователь может попросить найти нужный момент в разговоре, пересказать фрагмент или сделать краткое содержание всей записи с таймкодами. Нейросеть также различает собеседников. Все это может быть полезно при расшифровке совещаний, лекций, интервью, звонков и подкастов. Ассистент также сможет запоминать важные факты из голосового диалога и учитывать их позже. Эту функцию можно отключить или настроить в профиле.

По данным банка, точность распознавания эмоций у новой модели достигает 80%. Облегчённая версия GigaChat3.1-Audio-10B уже доступна разработчикам в open source. На её основе можно создавать голосовые переводчики, сервисы транскрибации и инструменты для работы с длинными аудиозаписями.

Также банк открыл доступ к GigaAM Multilingual — модели распознавания речи на русском, английском, киргизском, казахском и узбекском языках. Она подойдёт для кол-центров, голосовых ассистентов, автосубтитров и расшифровки встреч.

Подписывайтесь на «КП – Ульяновск» в MAX