Понятная справка по студии: озвучка, голоса и создание своего голоса, перевоплощение, расшифровка, экспорт, тарифы и API. Выберите тему слева. Для интеграций есть отдельная документация API.
Голосарь превращает текст в естественную речь нейросетью. Можно озвучивать сценарии, статьи, книги и рекламу системными или собственными голосами, расшифровывать аудио и видео в текст.
Первые шаги
Зарегистрируйтесь — при регистрации даётся 5 000 символов бесплатно, без привязки карты.
Выберите голос и язык, при желании настройте интонацию и скорость.
Нажмите «Озвучить», чтобы прослушать, и «Экспорт», чтобы скачать файл.
Прослушивание в редакторе — бесплатная проба (до 2 000 знаков за раз, плюс общий суточный лимит на объём прослушивания). Чтобы озвучить и скачать весь текст целиком, используйте «Экспорт».
Главный экран студии. Здесь вы вводите текст, выбираете голос и получаете аудио.
Ввод текста
Набрать или вставить — просто пишите в поле; счётчик показывает объём и лимит на запрос.
Надиктовать — продиктуйте голосом (до 30 секунд), мы распознаем и вставим текст.
Файл — загрузите .txt или .md.
Голос, язык, настроение и интонация
Внизу выберите голос и язык. Дальше — две РАЗНЫЕ вещи, их можно сочетать: настроение (эмоция — что чувствует диктор) и интонация (мелодика — как звучит: подъёмы, спады, паузы). Эмоцию задаёт кнопка «Настроение» (на выделенную фразу) или переключатель «Умное настроение» — ИИ сам расставит эмоции по всем предложениям. Мелодику — панель «Как читать» (Подъём/Спад/Пауза) или кнопка «Интонация» (ИИ разметит сам). Плюс — скорость речи в карточке справа.
Прослушать и скачать
Кнопка «Озвучить» проигрывает результат в браузере (бесплатная проба). Кнопка «Экспорт» создаёт готовый файл и списывает символы за весь текст один раз — подробнее в разделе «Как считаются символы».
Каждая генерация немного отличается — это нормально для нейросети. Понравившийся вариант можно закрепить, тогда звук перестанет меняться.
Тонкая настройка произношения по кускам текста — панель «Как читать» в редакторе.
Панель «Как читать»
Подъём ↑ — выделите слово или группу слов: они пойдут вверх по тону, прозвучат ярче.
Спад ↓ — выделенное идёт вниз по тону, тише и ниже (работает и в середине предложения).
Выделить — эмфаза на слово или группу слов (или Ctrl+B): прозвучат с упором.
Пауза — поставьте курсор и нажмите «Пауза» (Alt+P): в тексте появится значок ‖ — короткая пауза (~0,4 с) точно между словами.
Интонация (ряд «Текст и ИИ») — ИИ сам расставит подъёмы, спады и паузы по всему тексту (платный тариф).
Настроение — выделите фразу и выберите эмоцию (радостно, грустно, серьёзно и т.д.).
Ударение — задаёт ударный слог в слове, если движок прочитал неверно.
Не путать: «Интонация» (Подъём/Спад/Пауза) — это мелодика (как звучит), а «Настроение»/«Умное настроение» — это эмоция (что чувствует диктор). Разные оси, их можно сочетать.
Вся разметка подсвечивается в тексте цветом — сразу видно, где пауза, подъём, спад или выделение.
Второй ряд — «Текст и ИИ»
Здесь «Надиктовать», «Файл», выбор типа текста, «Подготовить» и «Интонация» — кнопка, которой ИИ сам расставляет подъёмы, спады и паузы по всему тексту (доступна на платном тарифе, как и «Подготовить»).
Пауза ‖ слышна и при прослушивании, и в скачанном файле. Для тишины именно в начале файла используйте «Пауза в начале» в блоке «Звук».
Создайте приватную голосовую модель по образцу записи (доступно с платного тарифа; число голосов зависит от тарифа).
Два способа
Быстрый — один образец 15–30 секунд, получаете свой голос за пару минут.
Студийный — образец 30–90 секунд с отдельным наговором эмоций, голос звучит выразительнее.
Эмоциональный паспорт
В студийном режиме вы по очереди наговариваете эмоции, а затем на шаге «Эмоциональный паспорт» слушаете, как ваш голос звучит в каждой из них, при желании подстраиваете силу подачи и сохраняете. Шаг можно пропустить.
Каким должен быть образец
Чистая речь одного человека, без музыки, шума и эха.
Быстрый режим — 15–30 секунд, студийный — 30–90 секунд, ровная громкость, ваш обычный голос.
Текст-расшифровка образца должен точно совпадать с записью.
Язык записи
Перед записью выберите язык, на котором будете говорить: 10 основных и 11 бета-языков (украинский, польский, нидерландский и другие — помечены значком β). Текст для чтения и фразы эмоций мастер покажет на выбранном языке, распознавание образца тоже пойдёт на нём. Клоны на бета-языках озвучиваются через авто-режим — работает, но без гарантии качества.
Загружайте только свой голос или голос, на который у вас есть права. Перед созданием нужно отметить согласие — см. «Права на голос и приватность».
Переносит исполнение — подачу и интонацию актёра — на выбранный голос (доступно с платного тарифа — Старт и выше).
Как это работает
Загрузите образец речи с нужной подачей — файлом или записью с микрофона прямо в мастере (до 3 минут).
Выберите голос, которым хотите «переозвучить» эту подачу.
Получаете тот же текст и интонацию, но другим тембром. Точная расшифровка не нужна — это не клонирование.
Точная настройка
Движок перевоплощения — «Модель 1» (быстрая, рекомендуем) и «Модель 2» (экспериментальная: дольше, иногда точнее передаёт тембр). Не понравился результат — попробуйте другую.
Похожесть голоса ↔ чистота речи — переключатель «Похожий голос / Баланс / Чистая речь»: «Похожий голос» — максимально близкий тембр (произношение может слегка «поплыть»), «Чистая речь» — чётче дикция, но тембр дальше от выбранного голоса.
Лучше всего работает чистая запись одного голоса без музыки и шума. Готовый результат можно доработать в редакторе — эквалайзер, «Сделать чище», фоны (см. Звук и эффекты).
Интерактивная страница «Лаборатория голоса»: один и тот же голос в разных эмоциях звучит по-разному — послушайте вживую, без регистрации.
Как это работает
Выберите голос и одну из 11 эмоций (нейтрально, радостно, воодушевлённо, нежно, спокойно, грустно, серьёзно, тревожно, сердито, испуганно, удивлённо).
Нажмите воспроизведение — меняется эмоциональная подача: эмоцию играет сама модель. Тембр в целом сохраняется; на ярких эмоциях возможен лёгкий сдвиг звучания — это нормально.
Понравилось — выбирайте голос из каталога или создайте свой и озвучивайте с этими же эмоциями в редакторе.
Там же — уровни языков (основные / бета / скоро) и голосование за язык, который мы добавим следующим.
Площадка авторских голосов: автор публикует свой голос, покупатель получает доступ к опубликованным голосам. Раздел готовится к запуску — открываем ранний доступ авторам.
Что это
Это следующий слой после системных и приватных голосов: автор оформляет карточку голоса (описание, теги, демо), подтверждает права, проходит модерацию — и голос становится доступен другим пользователям.
Как опубликовать свой голос (для авторов)
Создайте голос и сохраните понравившийся вариант звучания.
Оформите карточку: название, описание, демо, правила использования.
Подтвердите права на голос и отправьте карточку на модерацию.
После одобрения голос появляется в витрине; покупатель получает доступ после оплаты.
Доходы и выплаты
Продажи и доля автора учитываются в кабинете. На старте выплаты — по ручной заявке после проверки налогового статуса (самозанятый/ИП/юрлицо) и реквизитов. Точные условия и пороги — в документе «Правила выплат». Автоматизация выплат самозанятым прорабатывается отдельным этапом.
Голос — это персональные данные. Публиковать можно только свой голос или голос с оформленным согласием и правами — см. «Права на голос и приватность».
Аудио и видео в текст — с таймкодами и субтитрами (SRT/VTT). Разметка по говорящим и саммари — с тарифа Бизнес.
Как расшифровать
Загрузите аудио или видео — получите текст с таймкодами и субтитры в форматах SRT и VTT (кнопки «Скачать SRT» / «Скачать VTT» у готовой расшифровки). На Про расшифровка идёт сплошным текстом, без разметки по говорящим.
Язык можно указать вручную или нажать «Расшифровать как есть — язык определим сами»: движок сам распознает язык записи.
Разметка по спикерам, «Определить имена ИИ» и саммари — с тарифа Бизнес. «Определить имена ИИ» подставит имена говорящих по диалогу; если не уверен — оставит «Спикер N».
«Улучшить ИИ» — два режима: «Бережно» (чинит только явные ошибки распознавания) и «Причесать текст» (смелее: убирает повторы, поправляет грамматику).
Объём расшифровки в месяц зависит от тарифа (минуты включены на Про и выше); диаризация по спикерам и саммари — с тарифа Бизнес. Неудавшуюся расшифровку можно запустить заново кнопкой «Повторить».
Очень длинный текст (книга, большой сценарий) экспортируется в фоне: можно закрыть вкладку, по готовности придёт письмо. Прогресс виден в редакторе. Фоновый экспорт длинных текстов доступен на платном тарифе; короткие тексты можно экспортировать и на бесплатном.
Ровное чтение — статья/документ
Для статей, документов и другого «сплошного» текста в карточке «Формат экспорта» есть режим «Ровное чтение» (появляется от ~5000 знаков). Текст читается стабильным голосом от первого до последнего абзаца: единая манера, автоматическая замена слов, которые движок читает неверно, и контроль качества каждого фрагмента. Разметка «Как читать», эмоции и интонация в этом режиме не применяются — он для чистого текста. Этим же конвейером озвучены статьи нашего блога.
Повторное скачивание того же готового файла — бесплатно. Символы списываются один раз при создании файла.
Детали по готовым экспортам: где их найти, как долго хранятся и в каком качестве.
Где скачать повторно
Готовый файл скачивается сразу после экспорта. Повторное скачивание того же файла — бесплатно; символы за него уже списаны и заново не берутся.
Сколько хранятся файлы
Готовый экспорт остаётся доступен для повторного скачивания в вашем проекте. Мы не удаляем готовые файлы автоматически, но и бессрочное хранение не гарантируем: если файл важен, скачайте его себе сразу после готовности. Не нашли свой файл — напишите в поддержку.
Формат и качество
WAV — без сжатия, максимальное качество, для монтажа и дальнейшей обработки.
MP3 — компактный, примерно 192 кбит/с, удобен для публикации и пересылки.
Исходные аудио/видео, загруженные для расшифровки, хранятся недолго и автоматически удаляются — сам текст расшифровки остаётся в проекте.
Как перейти на другой тариф и как устроено продление.
Повысить тариф
Откройте раздел «Тариф и баланс» в студии и оплатите нужный тариф — новые лимиты и функции включаются сразу после оплаты.
Понизить тариф
Если нужен тариф ниже, выберите его в том же разделе при следующей оплате. По вопросам перехода в середине оплаченного периода и пересчёта — напишите в поддержку, поможем подобрать вариант.
Что в каком тарифе
Тариф задаёт: сколько символов входит в месяц, максимум символов на один запрос, число своих голосов, доступ к премиум-эффектам и умной подготовке текста, минуты расшифровки и доступ к API. Бесплатный — для проб; Про и выше открывают API и расширенные функции. Полная сравнительная таблица — на странице «Тарифы».
Срок действия тарифа
Тариф действует оплаченный месяц. Если его не продлить новой оплатой, тариф опускается на бесплатный — а купленные символы остаются на балансе и продолжают работать.
Автопродление
Автосписаний нет — тариф продлевается вручную новой оплатой в разделе «Тариф и лимиты». Никаких скрытых регулярных платежей: пока вы сами не оплатите следующий месяц, деньги не списываются.
Баланс символов и тариф — разные вещи: смена тарифа не обнуляет уже купленные символы на балансе.
Оплата идёт через ЮKassa: банковские карты РФ, СБП, Mir Pay и SberPay. Чек по 54-ФЗ приходит на e-mail после оплаты.
Безналичная оплата и договор для юрлиц
Онлайн-оплата работает картой и СБП. Если организации нужен договор или оплата по счёту, напишите в поддержку — обсудим оформление. Реквизиты компании опубликованы на странице «Реквизиты».
Аккаунт рассчитан на одного пользователя — отдельных командных мест и общих кабинетов пока нет.
Подтверждение почты, пароль, смена данных и удаление аккаунта.
Подтверждение email
Чтобы озвучивать, нужно подтвердить почту. В разделе «Аккаунт» запросите код — он придёт на email и действует 15 минут. Письмо не пришло — проверьте папку «Спам» и правильность адреса, запросите код повторно.
Сброс пароля
На странице входа нажмите «Забыли пароль?» и укажите email — придёт код для смены пароля (действует 15 минут). Не пришёл — проверьте «Спам» или напишите в поддержку.
Смена пароля
В кабинете в разделе «Аккаунт» можно сменить пароль — потребуется текущий пароль для подтверждения.
Смена email
Сменить адрес почты самостоятельно нельзя. Если нужно поменять email привязки — напишите в поддержку с текущего адреса.
Удаление аккаунта
В кабинете в разделе «Аккаунт» есть удаление аккаунта — потребуется ввести пароль для подтверждения. Аккаунт, голоса, проекты и история удаляются, сессия завершается. Действие необратимо.
Аккаунт рассчитан на одного пользователя — командных мест и общих кабинетов пока нет.
Премиум-эффекты, эквалайзер и умная подготовка текста доступны на платном тарифе. Если такой эффект включён в проекте на бесплатном тарифе, экспорт не начнётся — вернётся подсказка сменить тариф (код plan_required). Уберите премиум-обработку или перейдите на платный тариф.
Превью не воспроизводится
Проверьте звук и разрешение на воспроизведение в браузере, обновите страницу. Не помогло — напишите в поддержку и укажите браузер и устройство.
Голос пропал из списка
Возможно, голос был удалён. Если вы его не удаляли — напишите в поддержку, поможем восстановить.
«Вечная обработка» длинного экспорта
Длинные тексты обрабатываются в фоне. Если задача зависла надолго — запустите экспорт заново (символы за неудачную попытку возвращаются). Повторяется — напишите в поддержку.
«Сервис занят» / ошибка 503
Движок просыпается или обрабатывает очередь. Повторите запрос через несколько секунд.
Нужно подтвердить email, чтобы озвучивать: код подтверждения — в разделе «Аккаунт».
Чаще всего текст-расшифровка образца не совпадает с записью слово-в-слово. Перезапишите образец и впишите ровно то, что произносится. Помогает короткий и точный образец чистой речи.
Перевернулся пол голоса
Пересоздайте голос из чистого ровного образца 30–90 секунд. Если повторяется — напишите в поддержку.
«Достигнут лимит голосов тарифа»
Число своих голосов ограничено тарифом. Удалите ненужные голоса или повысьте тариф.
Загружать можно только свой голос или голос, на который у вас есть права (см. «Права на голос и приватность»).
Подтверждение оплаты иногда приходит с задержкой — подождите пару минут и обновите страницу. Если символы так и не пришли — напишите в поддержку и укажите e-mail, дату, время и сумму платежа; сверим и зачислим.
Двойное списание
Напишите в поддержку с деталями платежей — проверим и вернём лишнее.
Оплата не прошла / отклонён 3DS
Попробуйте другую карту или СБП, проверьте лимиты карты и подтверждение от банка. При неуспешной оплате деньги не списываются.
Возврат
Возврат оформляется тем же способом, которым была оплата, и обычно занимает до 5 рабочих дней (сроки указаны ориентировочно и уточняются по мере развития сервиса). По заявке на возврат — напишите в поддержку.
Автопродление
Регулярных списаний нет — тариф продлевается только вашей новой оплатой. Подробнее — в разделе «Смена тарифа и продление».
Бесплатно: при регистрации даётся 5 000 символов, без карты. Дальше — тариф или пакет символов.
Почему звук каждый раз немного разный?
Это нейросеть, она читает живо. Понравившийся вариант можно закрепить, и он перестанет меняться.
На каких языках работает озвучка?
21 язык с озвучкой: 10 основных с гарантией качества (включая русский и английский) и 11 в бете — они озвучиваются через авто-режим, качество дорабатываем. У каждого голоса свой родной язык, полный список — на странице языков.
Можно ли озвучить целую книгу?
Да, на платном тарифе: длинный текст экспортируется в фоне, по готовности придёт письмо. На бесплатном тарифе доступен экспорт коротких текстов.
Безопасно ли создавать свой голос?
Да: голос приватный, не публикуется без модерации, его можно удалить. Загружать можно только свой голос или с разрешения.