После выполнения этой инструкции вы создадите синтетический голос в ElevenLabs и получите аудиофайл из своего текста через официальный Text to Speech API.
Короткий ответ: на 2026-08-17 самый воспроизводимый сценарий такой: создайте API key, получите preview голоса через Voice Design, сохраните выбранный вариант как постоянный голос и отправьте текст в POST /v1/text-to-speech/:voice_id. Важное ограничение: ElevenLabs официально ограничивает доступ из России, Беларуси, Кубы, Ирана, Северной Кореи, Сирии, а также Крыма, Донецка и Луганска.
- Время: 20–35 минут
- Сложность: средний
- Стоимость: есть Free-план с 10,000 credits; точный расход зависит от модели, формата и текущего плана
- Что потребуется: аккаунт ElevenLabs, доступ к dashboard, API key, текстовое описание голоса, текст для озвучки; при работе из кода — Python или Node.js
- Актуальность: инструкция сверена по официальной документации ElevenLabs на 2026-08-17; в supplied sources нет публичного номера версии веб-интерфейса. На страницах репозиториев видны релизы Python SDK
v2.52.0и JS SDKv2.50.0, но перед pinning зависимостей проверьте их ещё раз
Редакционное ограничение: source pack подтверждает точный путь Voice Design в приложении и API-поток создания/озвучки, но не фиксирует, где именно в текущем веб-интерфейсе всегда удобнее копировать voice_id. Поэтому ниже используется путь через официальный API Explorer и документированные endpoint’ы: так вы видите идентификаторы прямо в ответах и не зависите от скрытых изменений UI.
Подготовка
Если вы хотите работать из кода, официальные SDK устанавливаются так:
pip install elevenlabs
npm install @elevenlabs/elevenlabs-js
Для всех API-запросов ElevenLabs использует API key в заголовке xi-api-key. Если вы работаете в изолированных окружениях EU, India или Singapore, документация отдельно предупреждает: там нужны другой API URL и отдельный API key.
Пошагово: как создать голос и сгенерировать аудио
-
Шаг 1. Проверьте, доступен ли для вас сервис и какое окружение вы используете.
Сначала убедитесь, что ваш аккаунт и география не попадают под официальные ограничения ElevenLabs. Если вас заблокировали ошибочно, сама компания рекомендует писать на
[email protected]. Отдельно решите, будете ли вы работать в глобальном окружении или в изолированном регионе.С 2026-02-09 глобальная маршрутизация включена по умолчанию, а
api-global-preview.elevenlabs.ioпомечен как deprecated. Если у вас старые скрипты или шаблоны запросов, не переносите их в продакшн без сверки с текущей документацией по окружению.Ожидаемый результат: вы понимаете, можете ли использовать сервис, и знаете, нужен ли вам отдельный региональный API URL и отдельный ключ.
-
Шаг 2. Создайте API key в dashboard и подготовьте его для запросов.
Откройте dashboard ElevenLabs и создайте API key. Официальная документация указывает, что этот ключ нужно передавать в заголовке
xi-api-key.xi-api-key: YOUR_API_KEYНе вставляйте ключ в клиентский код, публичный репозиторий или скриншоты. Если вы используете изолированное окружение EU, India или Singapore, создайте отдельный ключ именно для него: глобальный ключ там не заменяет региональный.
Ожидаемый результат: у вас есть рабочий API key, который вы можете использовать в API Explorer, скрипте или HTTP-клиенте.
-
Шаг 3. Сгенерируйте preview голоса через Voice Design.
Самый понятный no-code путь в приложении сейчас такой:
Voices → My Voices → Add a new voice → Voice Design. Там вы задаёте текстовое описание желаемого голоса и запускаете генерацию. Официальная документация подтверждает, что один запуск создаёт три варианта preview, а списание зависит от количества символов в preview-тексте и происходит один раз за цикл генерации.Если вам нужен полностью воспроизводимый API-поток, откройте страницу Design a voice в официальной документации и отправьте запрос к
POST /v1/text-to-voice/design. Для следующего шага зафиксируйтеgenerated_voice_idтого preview, который вам подходит.POST /v1/text-to-voice/design Headers: xi-api-key: YOUR_API_KEY Результат: несколько preview и generated_voice_id для каждого вариантаОжидаемый результат: у вас есть три preview-версии нового голоса и
generated_voice_idвыбранного варианта. -
Шаг 4. Сохраните выбранный preview как постоянный голос.
Теперь превратите выбранный preview в постоянный голос через endpoint
POST /v1/text-to-voice. По официальной документации для этого используются поляvoice_name,voice_descriptionиgenerated_voice_id.POST /v1/text-to-voice Headers: xi-api-key: YOUR_API_KEY Body fields: voice_name voice_description generated_voice_idПосле успешного запроса API Explorer показывает объект созданного голоса. Скопируйте оттуда
voice_id: именно его вы подставите в запрос озвучки.Ожидаемый результат: preview сохранён как постоянный голос, и у вас есть его
voice_id. -
Шаг 5. Отправьте текст в Text to Speech и получите аудио.
Для генерации речи используйте
POST /v1/text-to-speech/:voice_id. Официальный quickstart показывает стартовую конфигурацию сmodel_id='eleven_v3'иoutput_format='mp3_44100_128'.POST /v1/text-to-speech/:voice_id Headers: xi-api-key: YOUR_API_KEY Body fields: text model_id = eleven_v3 output_format = mp3_44100_128eleven_v3— текущая самая выразительная TTS-модель ElevenLabs. Документация отдельно отмечает её сильные стороны: audio tags, dialogue mode и поддержку 70+ языков. Но там же есть важная оговорка: у модели выше задержка, поэтому она не подходит для real-time и conversational use cases.Если вам нужна не максимальная выразительность, а иной баланс по скорости или расходу, сверяйтесь со страницами Models и Pricing перед массовой генерацией.
Ожидаемый результат: вы получаете аудиоответ в выбранном формате и можете сохранить его как MP3.
-
Шаг 6. Сохраните файл и локально прослушайте результат.
Официальный quickstart использует локальное воспроизведение, поэтому после получения ответа сохраните MP3 и сразу его прослушайте. Это самый быстрый способ понять, подходит ли голос под вашу задачу: ролик, подкаст, объясняющее видео или тестовый прототип.
Если качество не устраивает, не пытайтесь «докручивать» тот же voice blindly. Для Voice Design это часто означает: вернуться к шагу preview, переписать описание голоса и сгенерировать новую тройку вариантов. Документация прямо называет Voice Design экспериментальной возможностью, поэтому вариативность результата — ожидаемое поведение.
Ожидаемый результат: у вас есть готовый аудиофайл, который открывается локально и соответствует исходному тексту.
Как проверить, что всё работает
- Прослушайте файл. Официальная документация считает успешное воспроизведение основным признаком того, что TTS-запрос выполнен корректно.
- Проверьте заголовки ответа. Документация по API рекомендует смотреть служебные заголовки, например
character-costиrequest-id. Так вы увидите стоимость запроса в символах/кредитах и сможете сопоставить конкретный вызов с логами. - Проверьте идентификаторы. У вас должен сохраниться постоянный
voice_id, а не только временныйgenerated_voice_idиз preview. - Сделайте повторный короткий запрос. Отправьте ещё один короткий текст в тот же
voice_id. Если ответ снова приходит и голос совпадает по характеру, связка «голос + TTS» работает.
Частые ошибки и исправления
-
❌ Ошибка: запросы не проходят из-за доступа к платформе.
✅ Решение: проверьте, не попадаете ли вы под официальные страновые ограничения ElevenLabs. Если блокировка кажется ошибочной, компания рекомендует написать на
[email protected]. -
❌ Ошибка: ключ есть, но API не принимает авторизацию.
✅ Решение: убедитесь, что вы передаёте ключ именно в заголовке
xi-api-key. Если вы работаете в EU, India или Singapore, используйте отдельный API key и региональный API URL для этого окружения. -
❌ Ошибка: вы пытаетесь озвучить текст по
generated_voice_id.✅ Решение: сначала сохраните preview через
POST /v1/text-to-voiceи работайте уже с постояннымvoice_id. -
❌ Ошибка: озвучка слишком медленная для бота или звонка.
✅ Решение: не используйте
eleven_v3для real-time и conversational-сценариев. Документация прямо предупреждает о более высокой задержке у этой модели. -
❌ Ошибка: расход credits оказался выше ожидаемого.
✅ Решение: проверяйте live-страницу Pricing перед серийной генерацией. Free-план включает 10,000 credits, но фактический расход зависит от модели и плана; кроме того, preview в Voice Design тарифицируется по символам preview-текста за цикл генерации.
Безопасность и ограничения
- Не храните API key в открытом виде. Передавайте его только через безопасное хранилище секретов или серверную конфигурацию.
- Проверяйте регион. Для EU, India и Singapore нужны отдельные API URL и отдельные ключи; автоматический перенос глобальных настроек туда не гарантирован.
- Не используйте deprecated hostname. После изменения маршрутизации в феврале 2026 года старый
api-global-preview.elevenlabs.ioне стоит использовать в новых интеграциях. - Voice Design экспериментален. Качество может заметно меняться от формулировки описания. Если вам нужна максимально стабильная продакшн-озвучка, официальные материалы предлагают учитывать Professional Voice Clones как более предсказуемый вариант, если у вас есть подходящие исходные записи.
- Стоимость нельзя фиксировать раз и навсегда. В source pack нет одной универсальной цены за любой TTS-запрос. Для V2 Multilingual указано соотношение 1 character = 1 credit, а некоторые V2 Flash/Turbo и V2.5 Flash/Turbo API generations стоят 0.5–1 credit per character. Перед продакшн-запуском сверяйте актуальную страницу цен.
- Практический вердикт: для единичных озвучек и прототипов связка Voice Design + TTS удобна уже сейчас. Для real-time, строгой предсказуемости голоса и бюджетирования на больших объёмах сначала проверьте модель, регион и live pricing.
Что делать дальше
- Посмотрите карточку инструмента ElevenLabs, чтобы быстро перейти к официальным возможностям и сценариям использования.
- Если вам нужен говорящий персонаж, продолжите с инструкцией Как сгенерировать аватар-видео с HeyGen.
- Если вы хотите автоматически готовить тексты для озвучки, настройте своего GPT под сценарии дикторских текстов.
- Если хотите встроить озвучку в цепочку с ботом и логикой, посмотрите как создать чатбота с Flowise.
Источники
- API Authentication | ElevenLabs Documentation
- Introduction | ElevenLabs Documentation
- Voice Design | ElevenLabs Documentation
- Design a voice | ElevenLabs Documentation
- Create a voice | ElevenLabs Documentation
- ElevenAPI quickstart | ElevenLabs Documentation
- Create speech | ElevenLabs Documentation
- What is Eleven v3? | ElevenLabs Documentation
- Models | ElevenLabs Documentation
- ElevenLabs Pricing for Creators & Businesses of All Sizes
- February 9, 2026 | ElevenLabs Documentation
- Data residency | ElevenLabs Documentation
- Do you restrict access to the service and platform for any specific countries? – ElevenLabs
- GitHub – elevenlabs/elevenlabs-python
- Releases · elevenlabs/elevenlabs-js
Вопросы и ответы
Можно ли сделать всё без кода?
Часть потока — да: Voice Design доступен в приложении по пути Voices → My Voices → Add a new voice → Voice Design. Но для максимально воспроизводимого сценария создания постоянного голоса и генерации аудио эта инструкция опирается на официальные API endpoint’ы и Explorer.
Какую модель брать первой?
Если вам важнее выразительность, начните с eleven_v3: официальная документация называет её самой новой и самой выразительной моделью, с audio tags, dialogue mode и поддержкой 70+ языков. Если приоритет — низкая задержка, проверяйте другие модели на странице Models.
Сколько это стоит?
Free-план включает 10,000 credits. Дальше цена зависит от модели и плана. Для V2 Multilingual документация указывает 1 character = 1 credit, а часть V2 Flash/Turbo и V2.5 Flash/Turbo API generations тарифицируется в диапазоне 0.5–1 credit per character. Для боевого расчёта смотрите только актуальную страницу Pricing.
Подходит ли Eleven v3 для real-time-бота?
Нет, документация прямо предупреждает, что у eleven_v3 повышенная задержка, поэтому модель не подходит для real-time и conversational use cases.
Почему в разных регионах нужны разные ключи?
Потому что EU, India и Singapore оформлены как отдельные изолированные окружения с собственными API URL и собственными API keys. Глобальная настройка не заменяет региональную.