
Обновили 29.09.2026
8 нейросетей для озвучки текста на русском
Бесплатно озвучит Timbrica, в рублях — Zvukogram, с эмоцией — ElevenLabs
С 15 июля SaluteSpeech, который летом хвалили за 200 000 бесплатных знаков в месяц, закрыт для новых клиентов.
Идеального русского голоса нет, но выбор короткий. Бесплатно и без регистрации озвучивает Timbrica, и права на запись переходят вам. Для роликов и рекламы с оплатой в рублях подойдёт Zvukogram, у которого больше 140 русских голосов. Свои ролики мы озвучиваем ElevenLabs, он живее SpeechKit, но из РФ требует зарубежный адрес и карту.
Расскажу про восемь сервисов: три зарубежных, четыре российских и одну открытую модель для своего компьютера. Пять из восьми работают из РФ целиком, без зарубежной карты.
1. Кого знают, а кто работает
ElevenLabs знают почти в шесть раз лучше, чем Yandex SpeechKit: 46 баллов Индекса против 8. Но из РФ без смены адреса работает второй.
АгентыАгент: отдал задачу и ушёл — работа идёт.48 из ~410▸
АссистентыАссистент: вопрос → ответ; между шагами всегда ты.12 из ~150▸
КартинкиГенераторы: промпт → картинка за один выстрел.10 из ~500▸
ВидеоГенераторы: промпт → ролик за один выстрел.11 из ~300▸
Голос и музыкаГенераторы: промпт → голос или трек.9 из ~150▸
Документы и знанияАссистенты знания: конспекты, слайды, встречи.7 из ~400▸
ДизайнМакеты и интерфейсы; продукт целиком — «Агенты».2 из ~120▸
Поиск и исследованияОтветы с источниками; браузер-агенты — в «Агентах».4 из ~120▸
КомпаньоныОбщение и отношения: собеседник, а не помощник4 из ~60▸
Ниже места подборки в Индексе. Он показывает, насколько о сервисе говорят в рунете: запросы в поиске, упоминания, вакансии.
Места подборки в Индексе
Сайтов, которые стоят первыми в Яндексе по запросу «озвучка текста голосом», в Индексе нет вовсе. Люди ищут задачу, а не бренд. Замер Индекса от 22.09.2026.
2. Как нейросети озвучивают текст
Нейросеть для озвучки учится на записях речи вместе с их текстом. Потом она получает новый текст и предсказывает звук, каким его прочитал бы человек: с паузами, ударениями и интонацией.
Старые синтезаторы склеивали речь из кусочков и звучали как робот на вокзале. Новые подбирают интонацию под смысл фразы. От чата сервис озвучки отличается просто: чат-бот отвечает на вопрос, а сервис читает ровно ваш текст и отдаёт аудиофайл.
Работают сервисы похоже. Немного озвучки дают бесплатно, дальше вы платите за знаки, минуты или период.
Вот что уже умеют сервисы озвучки:
читают текст голосом диктора с паузами и ударениями и отдают mp3 или wav.
клонируют ваш голос по записи длиной от нескольких секунд до пары часов, смотря какой нужен клон.
играют эмоцию по пометкам прямо в тексте, например задумчиво, шёпотом или со вздохом.
переводят видео на другой язык и сохраняют голос говорящего.
Цены и лимиты я собрал по страницам вендоров в конце сентября 2026. Доступ из РФ проверил сам: открываются ли сайты с серверов в Москве и Петербурге.
Качество беру из двух источников. Слепое сравнение голосов людьми от Artificial Analysis меряет только английский, а открытый русский лидерборд оценивает речь машиной. Доллары пересчитаны по курсу ЦБ на 26.09.2026, 84,34 ₽.
🌎 Доступность в России. Из РФ целиком работают российские сайты и открытая модель, с оплатой в рублях или вовсе без неё. Из мировых зарубежный адрес нужен только ElevenLabs, а Fish Audio и MiniMax Audio работают, но российскую карту не принимают.
😃 Можно начать без оплаты. Бесплатно пробуются семь сервисов из восьми, только у SpeechKit отдельного бесплатного лимита нет. Но у ElevenLabs и Fish Audio бесплатная запись идёт без права на рекламу, а Timbrica отдаёт права и на бесплатных 3 000 знаках.
🗣 Ударения путают все. Фамилии и латиницу путает даже ElevenLabs. Помогает пометка ударной гласной, а числа и английские слова надёжнее написать словами.
Одного победителя я не искал: у каждого сервиса своя роль. Задача — показать, что работает из России и во что обходится.
Где работает: сайт elevenlabs.io и API; приложений в российских App Store и RuStore нет
Цена и условия: бесплатно около 10 минут речи в месяц, без права на рекламу; Starter $6 в месяц (506 ₽) с коммерцией и клоном голоса
Доступность в России: нужен зарубежный IP-адрес и зарубежная карта
В чём особенность: голос меняет подачу по пометкам в тексте, а клон своего голоса делается по записи короче полуминуты
Замер: в сентябре — двенадцатая из 91 модели в слепом сравнении Artificial Analysis на английском; русский мерили только машинной оценкой
Кому подойдёт: авторам роликов и подкастов, которым нужен живой голос или клон своего, если есть зарубежный адрес и карта
ElevenLabs — сервис озвучки из Нью-Йорка. Вставляете текст, выбираете голос из библиотеки или записываете полминуты своего и скачиваете файл. Тем же счётом кредитов оплачиваются перевод видео с сохранением голоса, звуковые эффекты и музыка.
Мы озвучиваем ElevenLabs короткие ролики с 21 сентября 2026. Начинали с SpeechKit, но у мужских голосов его основной модели всего три настроения: нейтральное, радостное и строгое.
Модель Eleven v3 понимает пометки в квадратных скобках, и голос по команде задумывается, понижает тон или вздыхает. Ровность голоса мы держим на 0,25. При высокой ровности модель почти не слышит пометок, а при совсем низкой два прогона одного текста звучат по-разному.
Слабое место ElevenLabs на русском — ударения в фамилиях и латинице. Помогает заглавная ударная гласная, а числа и английские слова для голоса мы пишем словами: «девяносто семь», а не «97».
Кредитов тарифа Starter хватает примерно на 42 ролика по 700 знаков. На сайте каждая генерация даёт два дубля, и кредиты уходят вдвое быстрее, чем через API.
Из РФ нужны два шага. Сначала поменяйте российский IP-адрес на иностранный: ElevenLabs сам закрывает вход с российских адресов. Потом платите зарубежной картой, Apple Pay или Google Pay. Пути оплаты собраны на странице «Оплатить ИИ из РФ».
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Слепое сравнение Artificial Analysis | 1197 Elo у v3 Conversational, 12-е место из 91 модели; Eleven v3 — 1168, 17-е; сравнение только на английском | 2026-09-26 |
| Русский | Открытый русский лидерборд, машинная оценка UTMOS (август 2025): клон голоса на Multilingual v2 — 3,31 из 5; ударения в фамилиях и латинице плавают, помогает заглавная ударная гласная | 2026-09-26 |
| Цены и лимиты | Бесплатно 10 000 кредитов в месяц, около 10 минут речи, без коммерции и с подписью «elevenlabs.io» в публикации; Starter $6 в месяц (506 ₽): 30 000 кредитов, около 30 минут, коммерческая лицензия и мгновенный клон; Creator $22 (1 856 ₽): около 121 минуты, профессиональный клон, первый месяц за полцены; на сайте каждая генерация даёт два дубля, кредиты уходят вдвое быстрее, чем через API | 2026-09-26 |
| Наш опыт | Голос наших коротких роликов с 21.09.2026: модель Eleven v3 с пометками в квадратных скобках, ровность голоса 0,25 (выше 0,6 пометки почти не слышны, ниже 0,2 два прогона одного текста расходятся); русских голосов в общей библиотеке на 21.09.2026 — 4 753; кредитов Starter хватает примерно на 42 ролика по 700 знаков | 2026-09-21 |
| Доступ из России | Россия в списке стран, которые вендор блокирует; проба 26.09.2026 с серверов в Москве и Петербурге — переадресация на двух узлах из трёх; оплата картой, Apple Pay или Google Pay, рублей нет; в российских App Store и RuStore приложений нет | 2026-09-26 |
Где работает: сайт fish.audio с русской версией, API и открытые модели
Цена и условия: бесплатно до семи минут в месяц, без права на рекламу; Plus $15 в месяц (1 265 ₽) за 200 минут с коммерцией
Доступность в России: работает, но российская карта не проходит
В чём особенность: за доллар даёт почти втрое больше минут, чем ElevenLabs на Starter, а клон голоса делается по записи от 15 секунд
Замер: в сентябре — двадцать первая из 91 модели в слепом сравнении Artificial Analysis на английском; на русском машинно мерили только старую открытую модель
Кому подойдёт: тем, кто озвучивает много и готов вычитывать ударения
Fish Audio — сервис озвучки с библиотекой голосов, которые загружают сами пользователи. Там же лежат голоса персонажей мультфильмов, и страница одного из них стоит первой в Яндексе по запросу «озвучка текста голосом персонажей».
Модель S2.1 Pro говорит на 83 языках, русский среди них. Автор vc.ru Александр Свиридович летом писал, что сервис «систематически путает ударения», а в брак у него уходило 30–40% сгенерированного.
Разработчикам Fish Audio до конца ноября 2026 отдаёт флагманскую модель через API бесплатно, без жёсткого лимита знаков. На бесплатном тарифе сайта коммерция запрещена, а свой голос в рекламу можно пускать только на платном.
Из РФ сайт открывается без смены адреса. Касса работает через Stripe, и по свидетельствам практиков российские карты он отклоняет. Пути оплаты собраны на странице «Оплатить ИИ из РФ».
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Слепое сравнение Artificial Analysis | 1139 Elo у S2.1 Pro, 21-е место из 91 модели; сравнение только на английском | 2026-09-26 |
| Русский | S2.1 Pro говорит на 83 языках, русский в перечне; открытый русский лидерборд мерил только старую открытую FishSpeech 1.5 — 3,18 из 5 по машинной оценке UTMOS (август 2025); vc.ru, Александр Свиридович (06.07.2026): сервис путает ударения, в брак уходит 30–40% сгенерированного | 2026-09-26 |
| Цены и лимиты | Бесплатно 8 000 кредитов в месяц, до 7 минут и до 500 знаков за раз, без коммерции; Plus $15 в месяц (1 265 ₽) или $11 при оплате за год (928 ₽ в месяц): до 200 минут, коммерция разрешена; Pro $100 (8 434 ₽): до 1 620 минут; за доллар на Plus в 2,7 раза больше минут, чем у ElevenLabs на Starter; флагманская модель через API бесплатна до 30.11.2026 | 2026-09-26 |
| Доступ из России | fish.audio открывался с серверов в Москве и Петербурге (26.09.2026); касса — Stripe, российские карты он отклоняет по свидетельствам практиков (vc.ru, 02.07.2026) | 2026-09-26 |
MiniMax Audio
Где работает: сайт minimax.io с русской страницей и API
Цена и условия: бесплатные кредиты выдают каждый день, их размер вендор не называет; Starter $5 в месяц (422 ₽)
Доступность в России: работает, но российская карта не проходит
В чём особенность: клон голоса по записи от 10 секунд, судя по документации вендора, и тариф за $5
Замер: в сентябре — шестнадцатая из 91 модели в слепом сравнении Artificial Analysis на английском; русский не мерили
Кому подойдёт: тем, кому нужен клон своего голоса дешевле ElevenLabs и есть зарубежная карта
MiniMax Audio — сервис озвучки шанхайской MiniMax, той же компании, что делает видеосервис Hailuo. По документации вендора вы загружаете запись своего голоса от 10 секунд до 5 минут, и сервис читает им любой текст.
В слепом сравнении на английском новая модель MiniMax стоит чуть выше Eleven v3 и ниже Eleven v3 Conversational. Разница с Eleven v3 в пределах погрешности, а вход дешевле: $5 против $6 у ElevenLabs.
Автор vc.ru в 2025 году советовал при клоне своего голоса явно выбирать русский язык. Докупленные кредиты живут два месяца.
Сам minimax.io из РФ мы не проверяли, а соседний сайт вендора Hailuo 6 сентября 2026 открывался без смены адреса. Касса MiniMax Audio работает через Stripe, поэтому нужна зарубежная карта.
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Слепое сравнение Artificial Analysis | 1172 Elo у Speech 2.8 HD, 16-е место из 91 модели: на 4 балла выше Eleven v3 (1168) и ниже Eleven v3 Conversational (1197); сравнение только на английском | 2026-09-26 |
| Цены и лимиты | Условия от 12.02.2026: ежедневные бесплатные кредиты, размер не назван; Starter $5 в месяц (422 ₽) за 100 000 кредитов; Standard $30 (2 530 ₽) за миллион кредитов; докупленные кредиты живут два месяца; через API — $100 за миллион знаков (8 434 ₽), клон голоса $1,5 (127 ₽); сколько знаков в кредите, на странице тарифов не написано | 2026-09-26 |
| Клон и русский | По документации вендора — запись голоса от 10 секунд до 5 минут; русский есть в списке языков API и на русской странице сервиса; vc.ru (26.06.2025): при клоне явно выбирать русский язык | 2026-09-26 |
| Доступ из России | Сам minimax.io из РФ не проверяли; соседний сайт вендора Hailuo открывался с московского сервера на нашей пробе 06.09.2026; касса MiniMax Audio — Stripe, российские карты не проходят | 2026-09-26 |
Где работает: Yandex AI Studio, это API и песочница Playground в браузере
Цена и условия: отдельного бесплатного лимита нет; около 650 ₽ за миллион знаков с НДС
Доступность в России: работает без проблем
В чём особенность: 24 русских голоса с амплуа, от нейтрального и радостного до шёпота и рассказчика
Замер: меньше всех ошибок произношения в открытом русском лидерборде, наравне с открытой Vosk; замер июня 2024 года
Кому подойдёт: тем, кто озвучивает много и готов разобраться с кабинетом разработчика
Yandex SpeechKit — движок синтеза речи Яндекса. Напрямую он продаётся разработчикам по знакам, а голоса Яндекса за токены продаёт и сайт Timbrica.
Первым голосом наших роликов в сентябре 2026 был SpeechKit, голос ermil в амплуа «радостный». Ролик в 700 знаков обходился примерно в полрубля.
Через день главным голосом стал ElevenLabs. У мужских голосов основной модели SpeechKit нет управления высотой и настроения сильнее «радостного». SpeechKit остался у нас вторым голосом и черновиком.
Ударение ставится прямо в тексте двойными звёздочками вокруг слова, а вставка sil<[300]> даёт паузу в 300 миллисекунд.
Данил Музафаров, инженер Raft, в апреле 2026 написал на Хабре, что в голосе «чувствуется некоторая роботизированность» рядом с новыми моделями. Зато, по его оценке, SpeechKit справляется с аббревиатурами и не ломается на длинных текстах.
Без кода работает песочница Playground в AI Studio, туда за раз вставляется до 5 000 знаков. В API голоса с амплуа доступны только в версии v3, один запрос берёт не больше 250 знаков, и текст приходится резать по фразам.
Из РФ SpeechKit работает целиком, с оплатой картой РФ и счётом в рублях с НДС.
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Цены с НДС | API v3: 0,1626 ₽ за каждые 250 знаков, около 650 ₽ за миллион; API v1: 1 342 ₽ за миллион знаков; свой голос Brand Voice Lite — 9 150 ₽ за создание и 101 666 ₽ в месяц за хранение; отдельного бесплатного лимита на синтез нет; новым аккаунтам Yandex Cloud — грант 4 000 ₽ на 60 дней, если привязать карту при создании платёжного аккаунта | 2026-09-26 |
| Открытый русский лидерборд | 0,6% ошибок произношения у голосов Marina и Alexander, меньше всех наравне с открытой Vosk-TTS; машинная оценка естественности UTMOS у Marina — 3,48 из 5 (июнь 2024) | 2026-09-26 |
| Голоса | 18 русских голосов основной модели с амплуа от нейтрального и радостного до шёпота и 6 голосов LiveTTS с амплуа вроде «рассказчика»; Playground в браузере — до 5 000 знаков за раз; в API v3 — не больше 250 знаков на запрос | 2026-09-26 |
| Наш опыт | Первый голос наших роликов 20.09.2026: ermil, амплуа «радостный», скорость 1,25; ролик в 700 знаков — около 0,49 ₽; с 21.09.2026 основной голос — ElevenLabs, SpeechKit остался вторым голосом и черновиком | 2026-09-21 |
| Мнение практика | Данил Музафаров, Raft, Хабр (15.04.2026): естественность 4 из 5, выразительность 5 из 5; в голосе «роботизированность» рядом с новыми моделями, но аббревиатуры и длинные тексты SpeechKit выдерживает | 2026-09-26 |
| Доступ из России | Российский вендор: оплата картой РФ, счёт в рублях с НДС | 2026-09-26 |
Zvukogram
Где работает: сайт zvukogram.com и API
Цена и условия: 1 000 знаков бесплатно без регистрации, дальше оплата токенами по рублю за штуку, пополнять можно на любую сумму
Доступность в России: работает без проблем
В чём особенность: больше 140 русских голосов и коммерческие права на всех тарифах без доплат
Замер: не проверяли, чьи голоса внутри, сервис не называет
Кому подойдёт: тем, кто озвучивает ролики и рекламу и хочет выбирать из русских голосов с оплатой в рублях
Zvukogram — российский сайт озвучки с оплатой по факту. Вставляете текст, выбираете голос и настройки, скачиваете файл.
Скачать можно MP3, WAV, OGG и Opus без водяных знаков. За одну озвучку сайт принимает до 2 миллионов знаков, а готовые файлы хранит 30 дней.
Условия меняются быстро. Летом без регистрации давали пять токенов, сейчас дают тысячу знаков, а после регистрации и подтверждения почты добавляют ещё десять токенов.
По запросу «озвучка текста голосом» Zvukogram крутит в Яндексе три рекламных объявления и стоит шестым в обычной выдаче. Из РФ сервис работает целиком, оплата в рублях.
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Цены | Без регистрации 1 000 знаков бесплатно, после регистрации и подтверждения почты ещё 10 токенов, это около 2 000 знаков голосом PRO; 1 токен = 1 ₽, пополнение на любую сумму, при пополнении от 500 ₽ — до 20% бонусных токенов; 1 000 знаков: стандартный голос — 1,4 токена и выше, PRO — 5–10, HD — 14 токенов; в июне 2026 без регистрации давали 5 токенов | 2026-09-26 |
| Файлы и права | MP3, WAV, OGG и Opus без водяных знаков; до 2 000 000 знаков за одну озвучку; файлы хранятся 30 дней; коммерческая лицензия включена во все тарифы | 2026-09-26 |
| Выдача Яндекса | Шестое место по запросу «озвучка текста голосом», третье — по «озвучка текста онлайн»; три рекламных объявления по первому запросу | 2026-09-26 |
| Доступ из России | Российский сайт, оплата в рублях; чьи голоса внутри, сервис не называет | 2026-09-26 |
Timbrica
Где работает: сайт timbrica.com, без регистрации
Цена и условия: бесплатно 3 000 знаков в сутки без входа; Премиум 449–1 249 ₽ разовым платежом за срок от трёх месяцев до года
Доступность в России: работает без проблем
В чём особенность: первое место в Яндексе по запросу «озвучка текста голосом», 194 голоса на 52 языках
Замер: не проверяли; внутри, по словам сайта, облачные голоса Microsoft
Кому подойдёт: тем, кому нужно бесплатно и без регистрации озвучить текст до 3 000 знаков в день
Timbrica — сайт-озвучка, который собирает в одном списке пять источников голосов. Бесплатно работают облачные голоса Microsoft и серверные голоса самого сайта. Голоса Яндекса и OpenAI идут за токены.
Русских голосов Microsoft на сайте 14, из них 7 бесплатные. Скачать озвучку можно в MP3 или WAV.
Права на результат сайт передаёт вам бессрочно, включая коммерческие, но не исключительные. В файл сайт вшивает метку, что голос создан ИИ. У ElevenLabs и Fish Audio бесплатная запись идёт без права на рекламу, а Timbrica отдаёт права и на бесплатной.
Премиум открывает 30 000 знаков за раз и 100 000 в сутки. Из РФ всё работает без смены адреса, Премиум оплачивается через СБП.
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Цены и лимиты | Без входа — 3 000 знаков за одну озвучку и 3 000 в сутки на голосах Microsoft и серверных голосах сайта; Премиум — 30 000 знаков за раз и 100 000 в сутки: 449 ₽ за 3 месяца, 749 ₽ за 6 месяцев, 1 249 ₽ за год, разовый платёж без автопродления, через СБП; голоса Яндекса и OpenAI — за токены, младший пакет 99 ₽ | 2026-09-26 |
| Голоса | 194 голоса на 52 языках из пяти источников: облачные Microsoft, серверные голоса сайта, HD прямо в браузере, студийные Яндекса и OpenAI; русских голосов Microsoft 14, из них 7 без Премиума | 2026-09-26 |
| Права | Права на результат переходят пользователю бессрочно, включая коммерческие, но не исключительные; в файл вшита метка, что голос создан ИИ; клона своего голоса нет | 2026-09-26 |
| Выдача Яндекса | Первое место по запросам «озвучка текста голосом» и «озвучка текста онлайн» | 2026-09-26 |
Где работает: сайт apihost.ru и API, озвучка в браузере без регистрации
Цена и условия: бесплатно до тысячи знаков за запрос каждый день; дальше 0,6–15 ₽ за тысячу знаков, смотря по классу голоса, по нашей карточке на 19.08.2026
Доступность в России: работает без проблем
В чём особенность: клон своего голоса в рублях, причём быстрый создаётся бесплатно
Замер: не проверяли
Кому подойдёт: тем, кто хочет озвучивать тексты своим голосом и платить рублями
Apihost — набор голосовых сервисов ИП Богомолова. В нём озвучка текста, клонирование голоса и расшифровка записей в браузере. Стартом работы сайт называет 2019 год.
Голосов в каталоге 3 017 на 83 языках, они разбиты по версиям V1, V5 и Studio. Версия означает семейство движков озвучки.
Быстрый клон Fast-clone создаётся бесплатно, а озвучка им стоит 5 ₽ за 1 000 знаков.
Профессиональный Pro-clone требует пакета Studio за 1 800 ₽ и списывает 1 000 ₽ за создание голоса.
На платных тарифах за раз озвучивается до 100 000 знаков, файл скачивается в MP3, WAV или OGG. Бесплатный демо-режим годится попробовать, для коммерции нужен платный тариф.
Пакеты включаются разовым пополнением кошелька, автосписаний нет. Из РФ сервис работает целиком, оплата в рублях.
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Цены и лимиты | Демо — до 1 000 знаков за запрос, лимит обновляется каждый день, суточный размер не назван; платно от 0,6 ₽ за 1 000 знаков на 26.09.2026, верх вилки 15 ₽ — по нашей карточке от 19.08.2026; пакеты Starter 490 ₽, Creator 990 ₽ и Studio 1 800 ₽ — разовое пополнение кошелька, автосписаний нет; на платных тарифах до 100 000 знаков за раз, файлы MP3, WAV или OGG | 2026-09-26 |
| Клон голоса | Fast-clone — создание бесплатно, озвучка 5 ₽ за 1 000 знаков; Pro-clone — только в пакете Studio, 1 000 ₽ за создание голоса, озвучка 6,5 ₽ за 1 000 знаков | 2026-09-26 |
| Голоса | 3 017 голосов на 83 языках, версии V1, V5 и Studio — семейства движков, чьи именно, сайт не называет | 2026-09-26 |
| Доступ из России | Российский сервис ИП Богомолова, работает с 2019 года по словам сайта; оплата в рублях; коммерция — на платных тарифах | 2026-09-26 |
Где работает: установщик голосов для Windows, код на GitHub и бот @silero_voice_bot в Telegram
Цена и условия: модель и установщик бесплатно; премиум в боте 350 ₽ в месяц через Boosty
Доступность в России: работает без проблем
В чём особенность: работает без интернета на обычном ноутбуке и сама ставит ударения
Замер: новую пятую версию машинно не мерили; старая четвёртая получила 2,1 из пяти по машинной оценке русского лидерборда летом 2024
Кому подойдёт: тем, кто хочет озвучивать бесплатно и без интернета для себя, не в рекламу
Silero — открытая модель синтеза русской речи от российской команды. Её ставят на свой компьютер, и дальше текст никуда не уходит.
Установщик для Windows из июньского релиза весит 194 МБ и добавляет голоса Silero в систему, как голоса для экранных читалок. Их подхватывает бесплатная программа «Балаболка»: вставили текст, выбрали голос, сохранили файл.
Видеокарта не нужна. По словам команды на Хабре, модель генерирует около 100 секунд звука за секунду.
Модель сама расставляет ударения, различает слова вроде «зáмок» и «замóк» и поднимает интонацию в вопросах. Данил Музафаров из Raft на Хабре в феврале 2026 поставил пятой версии четыре из пяти за естественность.
Главное ограничение касается лицензии. Основная русская модель разрешена только для некоммерческого использования. Базовые модели на 20 языков РФ и СНГ с русскими дикторами выложены под свободной лицензией MIT, их можно брать в работу.
Из РФ всё работает без условий, модель скачивается с сервера самой команды.
Что и как мы проверяли
| Факт | Что известно | Проверено |
|---|---|---|
| Лицензия | Основная русская модель v5_5_ru — CC BY-NC-SA 4.0, без коммерции; базовые модели на 20 языков РФ и СНГ с русскими дикторами (v5_cis_base) — MIT | 2026-09-26 |
| Установщик | Релиз v5.6 от 04.06.2026: установщики для Windows, русский весит 194 МБ и ставит голоса в систему; их подхватывают «Балаболка» и экранные читалки; по словам команды на Хабре (30.12.2025), около 100 секунд звука за секунду без видеокарты | 2026-09-26 |
| Замер | Открытый русский лидерборд (июнь 2024): Silero 4, голос Baya — 2,14 из 5 по машинной оценке UTMOS; версию 5 машинно не мерили; Данил Музафаров, Raft, Хабр (03.02.2026): версия 5 — 4 из 5 за естественность | 2026-09-26 |
| Бот | @silero_voice_bot в Telegram, на него ведёт сайт команды; премиум — 350 ₽ в месяц через Boosty | 2026-09-26 |
11. Кого не взяли и почему
В места брал сервисы, где частный человек получает файл с русской речью и до которых из РФ можно добраться хотя бы через зарубежный адрес. Из похожих брал тот, у кого больше бесплатного, понятнее права на запись, проще запуск или есть оплата из РФ. Остальные — здесь, с причиной.
SaluteSpeech. С 15.07.2026 Сбер не продаёт пакеты физлицам и закрыл им бесплатный тариф, а новым компаниям закрыл и покупку пакетов, и оплату по факту.
Microsoft Edge «Читать вслух» и Алиса в Яндекс Браузере. Бесплатно и без лимита, но это чтение вслух, а не файл для ролика. У Алисы озвучка работает на Windows и Android.
ChatGPT. Читает свои ответы вслух, но файла не отдаёт. Демо openai.fm я не проверял.
Google Gemini TTS. Второе место в слепом сравнении на английском и бесплатный тир API, но РФ нет в списке стран, а с августа доступ к Gemini рвётся и через зарубежный адрес.
Speechify. Прежде всего читалка, чтобы слушать книги и статьи, а не делать озвучку для роликов. Русские голоса поимённо я не нашёл, Premium стоит $29 (2 446 ₽).
Murf. Бесплатно слушать можно, скачать нельзя, клон только в корпоративном тарифе, Creator стоит $29 в месяц (2 446 ₽).
CapCut. Озвучка прямо в монтаже на телефоне, но русский голос вендор не называет.
HeyGen. Говорящий аватар в кадре, а не озвучка файлом.
Descript. Русскую речь не понимает.
Cartesia и Hume. Cartesia даёт коммерцию и клон за $5, Hume даёт клон даже бесплатно, но русский язык у обоих я не проверил.
WellSaid. Русского нет в списке языков.
PlayHT. Закрыт 31.12.2025.
Robivox и VoiceBot. Сайты в рублях. Внутри Robivox голоса Microsoft, ElevenLabs и Яндекса, у VoiceBot голоса носят имена голосов Яндекса и Microsoft. Бесплатно они дают 100 и 500 знаков, меньше, чем Timbrica.
Speechma и FreeTTS. Полностью бесплатны, по 2 000 знаков за раз без регистрации. Кто владелец и чьи голоса внутри, я не выяснил, а условия FreeTTS известны только по чужой подборке.
SteosVoice, бывший CyberVoice. Голоса персонажей игр и мультфильмов за 200–700 ₽ в месяц. На чём держатся права на узнаваемые тембры, я на сайте не нашёл.
TTSMaker. 20 000 знаков в неделю бесплатно, но живой сайт закрыт от проверки роботом, условия я видел только в архивной копии от 21.08.2026.
CosyVoice 3, Qwen3-TTS и Chatterbox. Открытые модели с правом на коммерцию и клоном, но им нужна видеокарта. У Qwen практики слышат азиатский акцент.
ESpeech. Русская открытая модель с клоном, по карточке лицензия свободная. Выросла ли модель из некоммерческих весов, в карточке не сказано.
XTTS-v2, F5-TTS и Fish Speech. Открытые, но им нужна видеокарта, а коммерция у них запрещена.
Piper и Vosk-TTS. Работают на обычном процессоре, но права неясны: у Piper коммерция спорная из-за исходных данных, у Vosk лицензию весов я не нашёл.
MWS AI и T-Bank VoiceKit. Облачные движки, как сервис для частного человека я их не проверял.
Azure и Google Cloud Text-to-Speech. Облака для разработчиков, из РФ их не оплатить.
12. Частые вопросы
Какая нейросеть лучше всего озвучивает текст на русском?+
Сами мы слушали два сервиса, и ElevenLabs живее SpeechKit, на котором мы начинали. С 21.09.2026 мы озвучиваем им свои ролики, голос играет эмоцию по пометкам в тексте. В слепом сравнении Artificial Analysis его модель двенадцатая из 91 и выше Fish Audio и MiniMax Audio, но это сравнение только на английском (26.09.2026). Из РФ ElevenLabs нужны зарубежный адрес и карта. Без смены адреса меньше всех ошибок произношения у Yandex SpeechKit: 0,6% в открытом русском лидерборде (июнь 2024), наравне с открытой Vosk.
Какая нейросеть озвучивает текст бесплатно?+
Из сервисов с понятными правами больше всего даёт Timbrica: 3 000 знаков в сутки без регистрации, файл mp3 и право на коммерцию даже на бесплатном (условия на 26.09.2026). По запросу «озвучка текста голосом» она первая в Яндексе. Speechma полностью бесплатна и берёт по 2 000 знаков за раз (26.09.2026), у FreeTTS те же условия по подборке Т—Ж от 29.06.2026. Чьи это сайты, я не выяснил. Совсем без лимита работает Silero на своём компьютере, основная модель при этом только для некоммерческого использования.
Где озвучить текст для роликов и рекламы с оплатой в рублях?+
В Zvukogram: больше 140 русских голосов, коммерческие права на всех тарифах без доплат и оплата по факту, 1 токен стоит 1 ₽ (условия на 26.09.2026). Права на рекламу даже на бесплатных 3 000 знаках в сутки отдаёт Timbrica. Озвучить своим голосом в рублях можно в Apihost.
Чем озвучить много текста недорого?+
Yandex SpeechKit: около 650 ₽ за миллион знаков в API v3 с НДС и оплата картой РФ (прайс на 26.09.2026). Это собственный движок Яндекса, но работать с ним придётся через кабинет разработчика. Нижняя цена Apihost ниже, 0,6 ₽ за 1 000 знаков (26.09.2026), но по нашей карточке на 19.08.2026 это младший класс голосов, а их движок сайт не называет.
Как сделать озвучку текста голосом?+
Вставьте текст в сервис озвучки, выберите голос и скачайте файл. Быстрее всего без регистрации это делается в Timbrica: до 3 000 знаков в сутки бесплатно (условия на 26.09.2026). Ударения в фамилиях и латинице проверьте на слух, а числа и английские слова надёжнее написать словами.
Где озвучить текст бесплатно без ограничений?+
Без лимита работает Silero на своём компьютере, но основная модель только для некоммерческого использования. Браузеры Edge и Яндекс бесплатно читают страницу вслух, но это прослушивание, а для ролика нужен файл. Из онлайн-сервисов полностью бесплатна Speechma, но за раз берёт до 2 000 знаков (26.09.2026). У FreeTTS те же условия по подборке Т—Ж от 29.06.2026.
Можно ли озвучить текст без регистрации?+
Да, и файл отдадут сразу. Timbrica даёт 3 000 знаков в сутки, Zvukogram и Apihost — по 1 000 знаков (условия на 26.09.2026).
Как озвучить текст своим голосом?+
Запишите свой голос и загрузите в сервис с клоном. В рублях это Apihost: быстрый клон создаётся бесплатно, профессиональный требует пакета Studio за 1 800 ₽ и списывает 1 000 ₽ за голос (26.09.2026). С зарубежным адресом и картой подойдёт ElevenLabs с тарифа $6. У MiniMax Audio клон через API стоит $1,5 за голос, нужна зарубежная карта. Для рекламы проверьте, что на тарифе есть коммерческая лицензия.
Какой ChatGPT может озвучить текст?+
ChatGPT читает свои ответы вслух кнопкой под сообщением, и на бесплатном тарифе тоже, но файл не сохраняет. Из РФ ChatGPT без зарубежного адреса не открывается (26.09.2026).
Как озвучить текст голосом Алисы?+
В Яндекс Браузере на Windows выделите текст на странице и выберите «Озвучить» или скажите «Алиса, прочитай страницу». На Android страница озвучивается через умную строку. Про скачивание аудио справка Яндекса на 26.09.2026 ничего не говорит.
Какой бот преобразует текст в голос?+
В Telegram работает бот Silero @silero_voice_bot, премиум стоит 350 ₽ в месяц через Boosty. Голосами персонажей озвучивает бот SteosVoice, подписка стоит 200–700 ₽ в месяц (цены на 26.09.2026).
Можно ли использовать озвучку нейросетью в рекламе и на YouTube?+
Зависит от тарифа. У ElevenLabs и Fish Audio бесплатная запись идёт без права на коммерцию. Timbrica передаёт права и на бесплатном, а у Zvukogram коммерция включена во все тарифы (условия на 26.09.2026).
Работает ли SaluteSpeech?+
Физлицам Сбер с 15 июля 2026 не продаёт новые пакеты и не продлевает бесплатный тариф, купленные раньше пакеты работают до конца срока. Новым компаниям с той же даты закрыты покупка пакетов и оплата по факту (страницы тарифов от 16.07 и 31.08.2026).
Как озвучить видео нейросетью?+
Проще всего озвучить текст в любом сервисе из списка и вставить файл в монтаж. ElevenLabs умеет переводить готовое видео на другой язык с сохранением голоса. В CapCut озвучка встроена в монтаж, но русский голос вендор не называет.
Источники
- Artificial Analysis — слепое сравнение голосов, Provider Voice (26.09.2026) — независимый замер
- Open TTS Leaderboard Ru — открытый русский лидерборд — независимый замер
- ElevenLabs — Pricing — официальный сайт
- ElevenLabs — страны с ограничением доступа — официальный сайт
- Fish Audio — тарифы — официальный сайт
- Fish Audio — модели и языки — официальный сайт
- Fish Audio — бесплатный API модели S2.1 Pro — официальный сайт
- vc.ru — Проблемы использования Fish Audio (06.07.2026) — пресса
- MiniMax Audio — Paid Service Terms (12.02.2026) — официальный сайт
- MiniMax — клон голоса, документация — официальный сайт
- MiniMax — цены API — официальный сайт
- vc.ru — Как озвучить текст своим голосом с MiniMax (26.06.2025) — пресса
- Yandex AI Studio — цены SpeechKit — официальный сайт
- Yandex AI Studio — голоса и амплуа SpeechKit — официальный сайт
- Yandex AI Studio — Playground синтеза речи — официальный сайт
- Yandex Cloud — стартовый грант — официальный сайт
- Хабр, Raft — Сравнение TTS-моделей на реальных задачах бизнеса (15.04.2026) — практики
- Хабр, Raft — Обзор Open Source моделей для задачи TTS (03.02.2026) — практики
- Zvukogram — озвучка текста — официальный сайт
- Timbrica — озвучка текста — официальный сайт
- Timbrica — цены — официальный сайт
- Apihost — озвучка текста — официальный сайт
- Apihost — тарифы — официальный сайт
- Silero на GitHub — официальный сайт
- Silero — релиз v5.6 с установщиками для Windows (04.06.2026) — официальный релиз
- Хабр, команда Silero — установщик голосов для Windows (30.12.2025) — официальный сайт
- Бот Silero в Telegram — официальный сайт
- SaluteSpeech — тарифы для физических лиц (16.07.2026) — официальный сайт
- SaluteSpeech — тарифы для юридических лиц (31.08.2026) — официальный сайт
- Яндекс Браузер — озвучивание текстов Алисой — официальный сайт
Дальше
Карточки с полными фактами: ElevenLabs · Fish Audio · Yandex SpeechKit · Apihost · Silero.
Как платить за зарубежные сервисы из РФ — «Оплатить ИИ из РФ».
Все инструменты для голоса и музыки — на карте ИИ-инструментов.
Наш курс «Агентная разработка»: как отдавать агенту проект целиком, от первой страницы до первого клиента.