ElevenLabs обновила речевую модель до v4: голос стал точнее в эмоциях и не «плывёт» на длинных текстах
ElevenLabs представила новую версию своей речевой модели — Eleven v4. Главные улучшения коснулись выразительности: ИИ точнее улавливает команды вроде «засмейся» или «прошепчи», а голос персонажа остаётся ровным на протяжении длинных аудиокниг или подкастов. Это решает типичную проблему предыдущих версий, когда интонация могла «уплывать» к концу записи.
Для сценариев, где скорость критична, доступен Eleven Turbo v4. Модель начинает говорить уже через 150 миллисекунд и оптимизирована для real-time голосовых ассистентов и агентов. ElevenLabs подчёркивает, что Turbo не жертвует качеством — просто быстрее обрабатывает запрос.
По данным платформы Artificial Analysis, на лидерборде Voice Arena v4 заняла первое место среди протестированных моделей, обойдя Cartesia и Google Gemini. Это подтверждает, что ElevenLabs сохраняет лидерство в синтезе речи, особенно в задачах, где нужна естественность и стабильность на длинных отрезках.