Сбер выпустил модель GigaChat Audio с новыми возможностями

от admin

Сбер выпустил модель GigaChat Audio с новыми возможностями

Включена функция обработки аудио.

Сбербанк выпустил обновленную нейросеть GigaChat Audio, снабженную новыми функциями.

Как сообщает ТАСС со ссылкой на пресс-службу СБ, новинка может обрабатывать аудиофайлы и голосовые сообщения, не преобразуя речь в текст. ИИ позволяет распознавать речь пользователя.

Также нейросеть обладает расширенными возможностями по обработке звуковой информации.

В СБ пояснили, что GigaChat Audio научился распознавать интонацию пользователей, от негативной до позитивной. Учитывается голосовые характеристики и произношение фраз.

Нейросеть может работать с записями протяженностью до трех часов.

У GigaChat  можно спросить о конкретном фрагменте беседы, попросить пересказать отдельный отрывок, заказать содержание беседы и ссылки на таймкоды. Модель различает и говорящих.

В следующих сессиях ИИ сможет использовать полученные в беседе даннные, учитывая ранние пожелания. К примеру, модель способна проложить маршрут с учетом привлекательности его для пользователя.

Сам клиент GigaChat сможет целиком контролировать функцию, то есть посмотреть факты, отредактировать их, отключить запоминание в любой момент.

Читать:
Apple обвинила создателей ChatGPT в краже секретных разработок и подала в суд

В итоге, распознавание речи и прочие функции вывели GigaChat  на уровень мировых аналогов, отмечают в Сбере.

Модель прошла «слепой» тест Arena Hard Audio на сравнение ответов разных моделей на одинаковые голосовые вопросы.

В Сбере отметили, что у GigaChat Audio 75% побед, у Gemini-3-Flash-preview — 77,5%, у Gemini-2.5-Pro — 62%. Точность распознавания модели составила 80%. У Qwen3-Omni-30B — 70%, у  Kimi-Audio — 62%.

Воспользоваться обновленным GigaChat Audio можно в ИИ-помощнике «ГигаЧат» и Open Source.

Related Posts

Оставить комментарий