ElevenLabs представила новые модели синтеза речи с поддержкой 90 языков
Компания ElevenLabs выпустила модели v4 и v4 Turbo для озвучки текста и голосовых помощников — с более точным контролем интонаций и поддержкой большего числа языков. Это может быть полезно бизнесу, который использует голосовых ассистентов для звонков клиентам.
29 сентября 2026, 15:10 0 комментариев
Что произошло. Компания ElevenLabs выпустила две новые модели синтеза речи — v4 и v4 Turbo. Они умеют точнее передавать интонации и эмоции в голосе, работают быстрее и поддерживают более 90 языков вместо 70 в предыдущей версии. По словам компании, наибольший рост качества озвучки заметен в японском, бразильском португальском, мандаринском и кантонском языках. Новая модель также позволяет клонировать голос человека, используя всего 10 секунд аудиозаписи.
Что это значит для бизнеса. Такие модели используют для голосовых помощников, которые отвечают на звонки клиентов или озвучивают рекламные и обучающие материалы. Разработчики говорят, что новая версия работает с меньшей задержкой, поэтому разговор с голосовым роботом получается более естественным — он может начинать говорить, пока «думает» отвечающая ему языковая модель. Также заявляется, что модель по-другому обрабатывает конфликтные ситуации и удержание звонка, что должно помочь быстрее решать вопросы клиентов. Для малого бизнеса это может означать более дешёвую и гибкую замену части работы колл-центра, но в источнике нет информации о цене и о том, доступен ли сервис в России.
ElevenLabs — крупный игрок на рынке синтеза речи, у компании уже работают клиенты среди крупных корпораций, а конкуренцию ей составляют другие стартапы и такие компании, как Google и OpenAI, которые тоже развивают голосовые технологии.
Подготовлено с помощью ИИ по материалам techcrunch.com
Обсуждение
0 комментариевКомментариев пока нет. Будьте первым, кто поделится мнением.
Обсуждать новости могут только зарегистрированные пользователи. Войти или зарегистрируйтесь.