Сбер улучшил ИИ-помощника ГигаЧат и открыл доступ к обновлённой модели распознавания речи и мультимодальной LLM
Новая модель
GigaChat Audio способна обрабатывать аудиофайлы и голосовые сообщения без предварительного преобразования речи в текст.
ИИ-помощник теперь может определять эмоциональную окраску речи: анализировать голосовые сообщения с учётом интонации, тембра и особенностей произношения и адаптировать стиль ответа под контекст.
Модель способна обрабатывать аудио продолжительностью до трёх часов. Пользователи могут запрашивать краткое содержание, находить фрагменты, получать ссылки на таймкоды и пересказывать отдельные части.
Семейство моделей автоматического распознавания речи
GigaAM Multilingual — первая российская открытая модель с поддержкой нескольких языков. Она обучена на 2 млн часов аудио на 70+ языках и уже доступна разработчикам в open source.
Развитие собственных ИИ-моделей укрепляет технологическое лидерство Сбера. Новые решения повысят востребованность сервисов, расширят возможности для бизнеса и разработчиков, а в долгосрочной перспективе — станут дополнительным драйвером роста.
SBER для инвесторов в MAX
Обсуждение 0
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram