Блог · Редакция FatherGPT · 8 мин · обновлено 11 августа 2026

ElevenLabs в России: как озвучить текст и чем платить

ElevenLabs — самый узнаваемый синтез речи: именно его голосами озвучена половина роликов, которые вы слышали за последний год. Разбираем по порядку: почему прямая оплата из России не проходит, что с этим делают, как выглядит доступ через FatherGPT и, главное, чего в такой схеме нет.

В чём сложность с прямым доступом

Сам сервис работает и на русском языке говорит хорошо. Упирается всё в оплату: подписка списывается зарубежным эквайрингом, и российская карта на этом шаге отваливается. Дальше человек обычно идёт по кругу — виртуальные карты, посредники, чужие аккаунты, — и каждый круг заканчивается либо переплатой, либо потерянным доступом в момент, когда озвучка нужна прямо сейчас.

Вторая, менее очевидная сложность — привязка к одному инструменту. Синтез речи почти никогда не нужен сам по себе: сначала текст надо написать или отредактировать, к ролику — подобрать картинку, к подкасту — описание. Держать под каждую задачу отдельную подписку с отдельной оплатой дорого просто по количеству платежей.

Ни один способ здесь не про «обход блокировок». Речь о том, чтобы платить российской картой за доступ к модели — ровно так же, как вы платите за любой другой онлайн-сервис внутри страны.

Как это устроено в FatherGPT

В кабинете есть раздел «Аудио», и модель там одна — Озвучка (ElevenLabs). Под ней действительно работает Multilingual v2, тот же движок, который вы слышали на официальном сайте. Мы не пересказываем его своими словами и не подменяем чем-то похожим: подпись в интерфейсе называет вещи своими именами.

Что это меняет практически: VPN не нужен, аккаунт заводить на зарубежном сервисе не нужно, оплата проходит российской картой, а рядом в том же кабинете лежат текстовые модели и генераторы картинок — то есть весь путь от сценария до готового аудио закрывается в одном окне и с одного баланса.

Баланс общий и считается в токенах. Одна озвучка — 200 токенов, независимо от длины: и на 60 знаков, и на 990 списывается одинаково. Подробнее про сам счётчик — в справке про токены.

Чего в этой схеме нет

Самое важное в статье — этот раздел, потому что именно здесь чаще всего ожидания расходятся с реальностью.

  • Клонирования голоса нет. Загрузить образец своей речи и получить её копию нельзя.
  • Голосов знаменитостей и персонажей нет. Запросы такие встречаются постоянно, но это ровно то, чего мы не делаем.
  • Голосов 22 — 11 женских, 10 мужских и один нейтральный. Описан характер только у четырёх опорных (Rachel, Sarah, Brian, George), остальные подписаны просто полом.
  • Ползунков эмоции, скорости и тембра нет. Интонация задаётся самим текстом — знаками препинания и формулировкой.
  • Лимит на генерацию — 1000 знаков. Длинный материал режется на куски вручную.

Если задача требует именно клонирования собственного голоса — наш вариант не подойдёт, и лучше узнать это сейчас, чем после оплаты.

Как Multilingual v2 звучит по-русски

Лучше, чем ожидают от синтеза. Модель держит естественную интонацию во фразе, не сваливается в роботизированную ровность на длинных предложениях и корректно проглатывает окончания там, где живой человек их проглатывает. На слух это ближе к спокойному диктору, чем к навигатору.

Слабые места тоже понятные и повторяемые. Ударения в редких словах, фамилиях и топонимах модель ставит по своему усмотрению и иногда мимо. Аббревиатуры читает как слова. Числа произносит по-разному в зависимости от контекста, а цену «1 990 ₽» может прочитать не так, как вы ожидаете.

Лечится это не настройками, а текстом: спорное слово пишется так, как должно звучать, аббревиатура разворачивается, число пишется словами. Приём простой, но именно он отделяет «сойдёт» от «звучит как запись живого диктора». Подробный разбор — в статье про качество русской озвучки.

Сколько это стоит по деньгам

Считать удобнее не в рублях за минуту, а в генерациях. Одна генерация — 200 токенов.

  • Пробный день за 1 ₽ — 300 токенов: одна озвучка и немного текстовых запросов сверху.
  • Неделя за 399 ₽ — 4 500 токенов: около 22 озвучек.
  • Месяц за 999 ₽ — 12 000 токенов: около 60 озвучек, и это при том, что тот же баланс тратится на текст, картинки и видео.

Бесплатный доступ даёт 40 токенов в сутки. Одна озвучка стоит 200 — на бесплатном тарифе она недостижима в принципе, накопить нельзя. Это честная арифметика, а не приём продаж: актуальные цены на странице тарифов.

С чего начать

  1. Возьмите короткий фрагмент своего реального текста — 3–4 предложения, не «проверка связи».
  2. Прогоните его на двух-трёх голосах — женском и мужском. Каждая проба стоит полные 200 токенов, поэтому перебирать все 22 подряд смысла нет: берите пробу сразу на реальном тексте.
  3. Послушайте, где сбилось ударение, и перепишите эти слова фонетически.
  4. Только после этого запускайте весь материал кусками по 1000 знаков.

Такой порядок экономит больше всего токенов: типичная ошибка — сразу отправить весь сценарий, получить неверное ударение в имени героя на второй минуте и переделывать всё целиком.

Другие языки, кроме русского

Модель называется Multilingual v2 не для красоты: она рассчитана на несколько десятков языков, и переключение происходит само — вы просто вставляете текст на нужном языке, отдельного выбора локали нет. Голос при этом остаётся тем же самым: Brian, читающий по-английски и по-русски, звучит узнаваемо одинаково.

На практике это удобно для двуязычных проектов: русская и английская версии ролика получаются одним голосом, и зритель воспринимает их как один продукт, а не как две разные записи. Для многоязычных курсов и презентаций это заметное преимущество перед схемой «под каждый язык свой диктор».

Ограничение честное: список языков конечен, и редкие в него могут не входить. Проверяется одной генерацией на короткой фразе — 200 токенов за определённость до того, как вы спланируете под это работу. Подробнее об этом в статье про перевод и озвучку.

Частые вопросы

Нет. Кабинет открывается из России как обычный сайт, модель вызывается с нашей стороны. Именно поэтому схема и появилась: она снимает не только вопрос оплаты, но и вопрос доступа.

Да, файл ваш, водяных знаков и обязательных упоминаний мы не добавляем. Права на сам текст, разумеется, остаются вашей ответственностью.

Готовое аудио, которое сразу кладётся на дорожку в монтаже. Дополнительной обработки не требуется: нормализация громкости и чистка от шума не нужны, потому что записи как таковой не было.

Токены вернутся на баланс автоматически. Это заложено в коде: неуспешная генерация не должна стоить денег.

Секунды. Дольше всего в этой работе занимает не синтез, а подготовка текста — правка ударений и разбивка на куски.

Попробуйте сами

Все нейросети из статьи доступны в одной подписке FatherGPT — без VPN, на русском, с оплатой картой РФ. Первый день стоит 1 ₽, чтобы спокойно всё проверить.