Бизнес27 августа в 16:01· 0:26
Сбер запустил аудиомодель GigaChat Audio с поддержкой контекста и эмоций
Сбер представил новую аудиомодель GigaChat Audio, которая может запоминать контекст длинных записей и распознавать эмоции говорящего. Разработчик протестировал модель на своём GPU RTX 4090, обработав различные рабочие задачи: транскрипцию докладов, встреч и кода-ревью. Результаты показывают, что модель эффективна для некоторых применений, хотя на сложных технических темах требует дополнительной проверки.
Тексты и озвучка в Пегрегаторе создаются автоматически: нейросеть кратко пересказывает публичные материалы Telegram-каналов. Это не оригинальные публикации и не работа редакции — смысл может быть упрощён, а детали потеряны. Перед принятием решений открывайте первоисточник: ссылки на каналы есть у каждого материала.
Слушать выпуск