Цены ElevenLabs, клонирование голоса и инженерия согласия по NO FAKES Act

Автор: Николай СапуновОбновлено: август 202619 мин чтения
Содержание статьи +

TL;DR

ElevenLabs – самый используемый коммерческий сервис синтеза речи и клонирования голоса, а его цены 2026 года тянутся от бесплатного тарифа без коммерческих прав до бизнес-плана за $990 в месяц, при том что практической точкой входа для клонирования служит план Creator. Клонирование бывает двух видов, которые нельзя путать: мгновенный клон всего из ~30 секунд аудио и профессиональный клон, который дообучает модель примерно на тридцати минутах записи и добавляет голосовую CAPTCHA – доказательство, что голос ваш. Два закона теперь определяют, что вам можно строить поверх этой возможности: предложенный американский NO FAKES Act, который создал бы федеральное право на голос и систему уведомлений-и-удаления, и Статья 50 EU AI Act, которая с 2 августа 2026 года обязывает маркировать и раскрывать ИИ-сгенерированное аудио. Статья разбирает цены, механику клонирования и инженерию согласия и раскрытия, нужную для того, чтобы голосовая фича вышла легально, а не превратилась в юридический риск.

Зачем это нужно

Если ваш продукт читает текст вслух, дублирует видео или даёт пользователю услышать собственный синтезированный голос, вы почти наверняка будете оценивать ElevenLabs и должны ответить на три вопроса до первой строки кода. Сколько это будет стоить на вашем реальном объёме? Что вам легально клонировать и как доказать наличие разрешения? И что вы обязаны раскрыть слушателю и регулятору? Эта статья для продакт-менеджера, основателя или техлида, принимающего решение build-or-buy по синтетическому голосу. К концу вы поймёте полную лестницу цен 2026 года и где она кусается, разницу между мгновенным и профессиональным клоном и согласие, которого требует каждый из них, и два регуляторных режима – один американский и предложенный, другой европейский и уже с датой, – которые превращают «мы клонировали голос» либо в фичу, либо в иск.

Что на самом деле продаёт ElevenLabs

Начнём с продукта, потому что цены имеют смысл только когда понятно, за что вы платите. ElevenLabs – компания, превращающая текст в произнесённое аудио с помощью моделей машинного обучения; эта задача называется синтез речи, по-английски text-to-speech, сокращённо TTS. Она же делает более сложную работу – клонирование голоса: строит синтетическую копию голоса конкретного человека, чтобы новые фразы звучали этим голосом. Думайте о простом синтезе речи как о найме обычного диктора, а о клонировании голоса – как о найме имитатора, который может сказать что угодно конкретным голосом.

Сам голос производит модель, и ElevenLabs поставляет несколько. Её флагман на начало 2026 года – модель v3, вышедшая в том же году и заметно лучше прежних передающая эмоцию; рядом стоят более быстрые и дешёвые модели Flash и Turbo, созданные для реального времени, где задержка в полсекунды ломает впечатление (ElevenLabs, 2026). Запоминать названия моделей не нужно. Важно унести вперёд одно: качество, скорость и цена торгуются друг с другом – выразительная модель стоит больше кредитов на символ, быстрая стоит меньше и отвечает быстрее.

Всё, что вы генерируете, измеряется в кредитах. Кредит – это единица потребления ElevenLabs, и для стандартных мультиязычных моделей правило простое: один символ текста – буква, пробел или знак препинания – равен одному кредиту (ElevenLabs Help Center, 2026). Быстрые модели Flash и Turbo дешевле – полкредита за символ (ElevenLabs Help Center, 2026). Кредиты, а не доллары, выдаёт каждый тариф, поэтому весь вопрос о цене сводится к «сколько кредитов я получаю и сколько мой продукт сжигает». Переведите кредиты в символы, а затем в минуты аудио до сравнения тарифов – почти любая ошибка в смете начинается с чтения большого числа кредитов так, будто это слова.

Лестница цен 2026 года, тариф за тарифом

ElevenLabs продаёт в 2026 году семь тарифов – от бесплатного до индивидуального корпоративного контракта. Цены ниже считаны прямо со страницы цен самой компании в мае 2026 года – это первоисточник; сторонние блоги часто приводят устаревшие цифры (ElevenLabs, 2026). Таблица – это карта. Читайте её как лестницу кредитов и прав, а не только цен: важнее всего здесь скачок не цены, а прав.

ТарифЦена/месКредитов/мес~Минут TTSКлонирование / доп.Коммерч. использование
Free$010 000~10 минНетНет
Starter$630 000~30 минМгновенный клонДа
Creator$22*121 000~121 мин+ Профессиональный клонДа
Pro$99600 000~600 минПрофессиональный клонДа
Scale$2991 800 000~1 800 мин+ 3 места, 3 PVCДа
Business$9906 000 000~6 000 мин+ 10 мест, 10 PVCДа
Enterpriseиндивид.индивид.индивид.+ HIPAA BAA, SSOДа

Источник: страница цен ElevenLabs, считана 2026-05-31. *Creator: первый месяц $11, далее $22. ~1 000 кредитов ≈ 1 минута (Multilingual); модели Flash и Turbo стоят ~полкредита за символ; годовая оплата экономит ~2 месяца. Где сторонние блоги приводили иные цифры (Starter $5, Creator 100k, Scale $330 / 2M, Business $1,320 / 11M), приоритет у страницы вендора, а эти вторичные значения отброшены.

Две строки этой таблицы заслуживают пристального взгляда, потому что они ловят команды.

Первая ловушка – бесплатный тариф. Он даёт 10 000 кредитов в месяц – около десяти минут речи – и реально полезен для прототипа, но не даёт никаких коммерческих прав и никакого клонирования голоса, а любой публичный контент должен указывать ElevenLabs (ElevenLabs, 2026). Вы не можете легально монетизировать ничего, сгенерированного на нём. Самый дешёвый тариф, разрешающий коммерческое использование аудио, – Starter за $6 в месяц, и именно эту черту настоящий продукт пересекает первым.

Вторая ловушка – план Creator. Это первый тариф, открывающий профессиональное клонирование, версию высокого качества, и именно его, по данным о ключевых запросах, ищут чаще всего после самого названия бренда (ElevenLabs, 2026). Starter, ступенькой ниже, даёт только менее точный мгновенный клон. Так что практическая точка входа для серьёзной голосовой фичи – план Creator, а не Starter; эту разницу стоит зафиксировать в бюджете до того, как кто-то удивится.

Рисунок 1. Лестница тарифов 2026 года. Два порога, ловящих команды, – линия коммерческих прав на Starter ($6) и линия профессионального клонирования на Creator.

Разбор примера – во что реально обходятся 200 минут в месяц

Числа делают это конкретным. Допустим, ваш продукт озвучивает статьи и генерирует 200 минут речи в месяц на стандартной мультиязычной модели. Проще всего посчитать это по тарифу pay-as-you-go в API: $0.10 за 1 000 символов. При ~150 словах в произнесённую минуту и шести символах на слово:

200 минут × 150 слов/минуту = 30 000 слов в месяц
30 000 слов × 6 символов/слово = 180 000 символов в месяц
180 000 символов ÷ 1 000 = 180 единиц по тысяче символов
180 единиц × $0.10 = около $18 в месяц, по API

Теперь сравните это с подпиской. План Creator включает 121 000 кредитов – примерно 121 минуту – за $22 в месяц после первого месяца, так что 200 минут его превысят и подтолкнут к плану Pro за $99 за 600 000 кредитов, большую часть которых вы не используете:

План Pro: $99 за ~600 минут → 200 использовано, ~400 в запасе (много отходов)

Для такого объёма pay-as-you-go API (~$18) выгоднее и перерасхода на Creator, и прыжка на Pro ($99). Урок обобщается: подписка рассчитана на стабильное, предсказуемое потребление, а API оплачивается поединично и выигрывает при умеренном или рваном объёме. Смоделируйте реальные месячные минуты, переведите в символы, затем сравните тариф API с самой дешёвой подпиской, которая вас покрывает, – ответ меняется с объёмом. Переход на более быструю модель Flash вдвое снижает стоимость символа ($0.05 за 1 000) и снова сдвигает точку безубыточности.

Мгновенное против профессионального клонирования голоса

Клонирование голоса в ElevenLabs – не одна фича, а две, и путаница между ними – самая частая ошибка планирования, которую мы видим. Они отличаются объёмом нужного аудио, временем, качеством и – это важно для закона – тем, насколько затрудняют клонирование без разрешения.

Мгновенный клон голоса, по-английски Instant Voice Clone или IVC, – быстрый и лёгкий вариант. Он строит пригодную копию голоса всего из ~30 секунд чистого аудио, и клон готов за секунды (ElevenLabs voice cloning, 2026). Почему он мгновенный – стоит знать: он делает few-shot-адаптацию, передавая вашу запись модели как живой образец в момент произнесения – «звучи как вот это» – без переобучения. Представьте умелого пародиста, который слышит короткий отрывок и тут же подражает ему. Доступен с тарифа Starter за $6. Расплата следует из механизма: потолок качества задан этим одним образцом, поэтому фоновый шум проходит насквозь; он хуже обобщает, когда просят сильно другую эмоцию, чем в образце; и несёт более лёгкую проверку согласия – вы подтверждаете, что имеете право клонировать голос, и это весь барьер (ElevenLabs voice cloning, 2026).

Профессиональный клон голоса, по-английски Professional Voice Clone или PVC, – вариант высокой точности, и внутри он работает иначе. Вместо использования вашего аудио как подсказки в момент речи PVC дообучает модель – реально подстраивает её внутренние настройки, чтобы глубже представить целевой голос, как актёр изучает часы материала, пока не сможет стать человеком в любом настроении (ElevenLabs voice cloning, 2026). Ему нужно около тридцати минут качественного аудио, качество записи важнее, потому что дефекты впекаются в настройки, и сборка занимает минуты, а не секунды. Требует тарифа Creator за $22 или выше, отражая потребляемые вычисления. И прежде чем продолжить, ElevenLabs заставляет вас пройти голосовую CAPTCHA: приложение показывает текст, и вы должны прочитать его вслух в отведённое время, после чего система сравнивает эту живую запись с загруженными образцами и подтверждает, что голос действительно ваш (ElevenLabs voice cloning, 2026). Эта запись чтения вслух – инженерия согласия, встроенная в продукт: она сильно затрудняет клонирование чужого голоса из украденного аудио, потому что пришлось бы воспроизвести голос вживую по требованию.

Рисунок 2. Мгновенный против профессионального клонирования. Профессиональный клон меняет скорость на точность и добавляет записанную голосовую CAPTCHA, которой у мгновенного нет.

Практическая маршрутизация ясна. Используйте мгновенный клон для низкорисковых, высокообъёмных и быстрых задач – пользователь слушает превью собственного голоса, быстрый черновик озвучки. Используйте профессиональный клон для голоса, на который опирается продукт – фирменный диктор, именованный ведущий, повторяющийся персонаж, – где и точность, и более сильная проверка окупаются. И в любом случае галочка согласия и CAPTCHA – это ElevenLabs, защищающая себя; они не снимают с вас юридическую обязанность иметь разрешение, о чём следующие разделы.

Как ElevenLabs борется со злоупотреблением

До закона есть собственная политика платформы, и она строже, чем ждёт большинство команд. ElevenLabs держит несколько слоёв защиты против злоупотребления голосом, и понимание их говорит вам, что можно и чего нельзя строить (ElevenLabs safety, 2026; ElevenLabs use policy, 2026).

Первый слой – уже описанная голосовая CAPTCHA, запирающая профессиональное клонирование за живым чтением вслух. Второй – автоматическая блокировка высокорисковых голосов: платформа обнаруживает и отклоняет попытки клонировать знаменитостей, политиков и других публичных лиц, с повышенной бдительностью к политическим фигурам в период выборов, чтобы предотвратить фабрикацию предвыборного аудио (ElevenLabs safety, 2026). Третий – постоянная модерация контента: смесь ИИ-классификаторов, людей-ревьюеров и внутренних расследований, следящих за нарушениями Политики запрещённого использования (ElevenLabs safety, 2026). Поверх этого аккаунт может нести живую модерацию, ограничивающую, для каких категорий контента можно использовать данный голос.

Сама Политика запрещённого использования банит очевидный вред: выдачу себя за человека ради мошенничества, подавление избирателей, имитацию политических кандидатов или чиновников независимо от заявленной авторизации, и иные обманные или вредные применения (ElevenLabs use policy, 2026). Для команды продукта вывод в том, что ElevenLabs не станет добровольным партнёром в клонировании публичной фигуры или политической имитации, и фича, зависящая от любого из этого, упрётся в стену в модерации, а не только в суде.

Есть и конструктивная сторона. ElevenLabs держит Voice Library – библиотеку, где владельцы голоса могут разместить его и получать выплаты, когда им пользуются другие; это маркетплейс, превращающий согласие в источник дохода, а не в галочку (ElevenLabs payouts, 2026). Если вашему продукту нужен отличительный голос, а клонировать нечего, лицензирование из этой библиотеки – чистый путь: согласие и вознаграждение берёт на себя платформа.

NO FAKES Act – федеральное право на собственный голос

Теперь закон. Самый значимый предложенный американский законопроект для всех, кто строит голосовые фичи, – это NO FAKES Act (Nurture Originals, Foster Art, and Keep Entertainment Safe Act), внесённый в Сенат как S.1367 и в Палату представителей как H.R.2794 в 119-м Конгрессе и повторно внесённый в апреле 2025 года после того, как версия 2024 года застопорилась (Congress.gov S.1367, 2025; Coons, 2025). На май 2026 это законопроект, ещё не закон, но это самый чёткий сигнал, куда движутся правила США, и его поддерживают несколько крупных игроков технологий и индустрии развлечений – SAG-AFTRA, RIAA, OpenAI, Google, Disney, Adobe (Coons, 2025).

Законопроект создал бы первое в истории федеральное право на голос и визуальный облик человека – то, что он называет правом на цифровую копию (digital replica) (Manatt, 2025). Цифровая копия в формулировке законопроекта – это вновь созданное, сгенерированное компьютером, крайне реалистичное представление, легко опознаваемое как голос или визуальный облик конкретного человека (Congress.gov S.1367, 2025). Сегодня возможность судиться из-за несанкционированного клона голоса зависит от лоскутного одеяла штатных законов о праве на публичность; NO FAKES Act задал бы национальную планку.

Механизм, самый важный для команды продукта, – система уведомления и удаления (notice-and-takedown), намеренно построенная по образцу режима удаления по авторскому праву, который площадки уже знают по DMCA (Manatt, 2025). Законопроект не требует от онлайн-сервиса проактивно сканировать несанкционированные копии. Вместо этого сервис, хостящий пользовательский контент, получает безопасную гавань – защиту от ответственности – если по получении валидного уведомления оперативно удаляет нарушающую копию, и если зарегистрировал назначенного агента в Бюро авторских прав США и принял политику отключения повторных нарушителей (Manatt, 2025). Это та же форма, что и у безопасной гавани по авторскому праву, так что если ваша площадка уже ведёт процесс DMCA, шаблон у вас есть.

Штрафы – вот почему это не сноска. Законопроект назначает законный штраф $5 000 за нарушение, и каждая сделанная, переданная или показанная копия считается отдельным нарушением – так что один вирусный ролик умножается быстро (Wikipedia NO FAKES, 2026; GovTrack S.1367, 2025). Чтобы уравновесить это, отправка ложного уведомления об удалении несёт собственный штраф – больше из $25 000 или фактического ущерба, что должно сдерживать злоупотребление системой удаления (GovTrack S.1367, 2025). Законопроект также устанавливает посмертные права – право на голос переживает смерть и администрируется через систему регистрации в Бюро авторских прав – и явно не отменяет законы штатов, существовавшие на 2 января 2025 года, так что ELVIS Act штата Теннесси и похожие статуты живут рядом с ним (GovTrack S.1367, 2025).

У него есть и критики. Цифровые правозащитные группы, включая EFF и FIRE, предупреждают, что широкое новое право на облик может охладить законную речь – пародию, комментарий, журналистику, – и законопроект отчасти пересматривался в ответ (EFF, 2024). Для ваших целей разумная позиция – проектировать так, будто обязанность уведомления-и-удаления и сильное ожидание согласия уже наступают, потому что направление движения ясно, даже если финальный текст ещё нет.

EU AI Act, Статья 50 – раскрытие уже с датой

Если NO FAKES Act – это будущее, к которому стоит готовиться, то Статья 50 EU AI Act – это дедлайн, который нельзя игнорировать: её обязанности по прозрачности применяются с 2 августа 2026 года (EU AI Act Article 50, 2026). В отличие от правил для высокорисковых систем в других частях Акта, Статья 50 охватывает любую генеративную ИИ-систему, что прямо включает инструменты синтеза аудио (EU AI Act Article 50, 2026).

Статья 50 делит обязанность между двумя ролями. Если вы провайдер – тот, кто создаёт систему генерации, роль ElevenLabs, – вы должны обеспечить, чтобы синтетическое аудио на выходе было размечено в машиночитаемом формате и распознавалось как искусственно сгенерированное, например встроенным сигналом происхождения или водяным знаком (EU AI Act Article 50, 2026). Если вы деплойер – тот, кто использует такую систему, чтобы произвести дипфейк для аудитории, что часто ваша роль, – вы должны раскрыть людям, что контент был искусственно сгенерирован или изменён (EU AI Act Article 50, 2026).

Есть ограниченные исключения. Если контент явно художественный, сатирический или вымышленный, обязанность раскрытия смягчается до ненавязчивого уведомления, не портящего произведение, а применения правоохранителей освобождены (EU AI Act Article 50, 2026). Кодекс практики, прописывающий, как именно маркировать и помечать контент, на начало 2026 года был во второй редакции, а финальная версия ожидалась около июня 2026, как раз перед августовским дедлайном (EU AI Act Article 50, 2026; Jones Day, 2026). Для продукта, обслуживающего пользователей в ЕС, инженерное следствие конкретно: встройте поверхность раскрытия – видимую метку, устное или письменное уведомление «сгенерировано ИИ» – в любую фичу, которая выдаёт клонированный или синтетический голос, и положитесь на машиночитаемую разметку провайдера для половины с происхождением.

Частая ошибка – считать галочку согласия юридической защитой

Самая вредная ошибка, которую мы видим, – команда полагает, что раз ElevenLabs заставила поставить галочку «я имею право клонировать этот голос», их юридическая обязанность исполнена. Это не так. Та галочка защищает ElevenLabs по её собственным условиям; она ничего не даёт вам в смысле разрешения, которого закон требует от самого человека, чей голос вы клонировали. Если вы клонируете голос сотрудника для внутреннего обучающего видео, а он позже возражает, или клонируете фриланс-диктора без пункта о синтетическом переиспользовании, галочка платформы – не защита.

Решение – спроектировать согласие как запись, а не как клик. Для любого голоса, который вы клонируете, зафиксируйте и храните явное, письменное, ограниченное по объёму разрешение от человека: какой голос, для каких применений, на какой срок и с каким правом отзыва. Относитесь к этому как к подписанному релизу модели в фотографии. Где есть контракт – диктор, ведущий, сотрудник – добавьте явный пункт о синтетической генерации голоса, её допустимых применениях и вознаграждении, потому что общий релиз на появление, написанный до появления клонирования голоса, почти никогда его не покрывает. Эта запись согласия – ещё и то, что позволяет вам чисто ответить на уведомление об удалении в стиле NO FAKES: вы показываете разрешение, а не мечетесь.

Где здесь Фора Софт

Мы встраиваем голосовые фичи в видеопродукты наших клиентов, и выбор голосового движка и дизайн согласия вокруг него всплывают почти в каждом. Мы подключали синтетические и клонированные голоса в e-learning-курсы, которым нужен единый диктор на сотни уроков, в телемедицинские инструменты, читающие инструкции вслух, в OTT-платформы, авто-дублирующие каталог, и в видеоконференц-фичи, озвучивающие живые субтитры. Повторяющийся урок в том, что модель – лёгкая часть. Сложная часть – окружающая инженерия: моделирование стоимости на реальном месячном объёме, а не на цене из заголовка, выбор мгновенного против профессионального клона под сценарий, фиксация и хранение ограниченного согласия, чтобы на уведомление об удалении можно было ответить за минуты, и построение раскрытия «сгенерировано ИИ», которого теперь требует Статья 50 для аудитории ЕС. Мы проектируем слой согласия и раскрытия первым, а движок выбираем потом, потому что голосовая фича, которая не может доказать разрешение, – это риск, как бы хорошо она ни звучала.

Как решить – пять вопросов

Решение сводится к пяти вопросам по порядку.

Первый: вам нужен голос конкретного человека или просто хороший голос? Если подойдёт любой естественно звучащий диктор, пропустите клонирование вовсе и возьмите стоковый голос или голос из библиотеки – он дешевле, быстрее и без рисков согласия.

Второй: каков ваш реальный месячный объём в минутах? Смоделируйте его, переведите в символы и сравните тариф API с самой дешёвой подпиской, которая вас покрывает. Самый дешёвый вариант меняется с объёмом, а модель Flash может сдвинуть точку безубыточности.

Третий: мгновенный или профессиональный клон? Мгновенный – для низкорисковых, быстрых, высокообъёмных превью; профессиональный – для голоса, на который опирается продукт, где важны и точность, и проверка голосовой CAPTCHA.

Четвёртый: можете ли вы доказать согласие? Для каждого клонированного голоса держите явное письменное ограниченное разрешение от человека и пункт о синтетическом голосе в любом контракте. Галочка платформы недостаточна.

Пятый: обслуживаете ли вы пользователей ЕС или ждёте ужесточения правил США? Если да, постройте поверхность раскрытия для Статьи 50 уже сейчас и спроектируйте хостинг под уведомление-и-удаление в стиле NO FAKES, чтобы соответствие было фичей, которая у вас уже есть, а не пожарной тревогой позже.

Рисунок 3. Пять вопросов по порядку маршрутизируют большинство проектов синтетического голоса к нужному тарифу и нужному дизайну согласия.

Ключевые выводы

  • У бесплатного тарифа ElevenLabs нет коммерческих прав; реальная точка входа – Starter ($6), профессиональное клонирование – с Creator.
  • Единица – кредиты, а не доллары: переведите кредиты в символы и минуты, затем сравните тариф API с самой дешёвой подходящей подпиской.
  • Мгновенному клону нужно ~30 секунд и галочка; профессиональный дообучается на ~30 минутах и добавляет записанную голосовую CAPTCHA.
  • Платформа блокирует голоса знаменитостей и политиков и модерирует контент – проектировать под эти применения не выйдет.
  • NO FAKES Act создал бы федеральное право на голос со штрафом $5 000 за копию и DMCA-подобным уведомлением-и-удалением.
  • Статья 50 EU AI Act с 2 августа 2026 требует маркировать и раскрывать ИИ-сгенерированное аудио.

Что почитать дальше

Строите такую систему?

Подберём параметры кодирования под ваш контент и посчитаем стоимость доставки до старта разработки.