Карта ИИ/Инструменты/Голос и музыка
в каталоге с 19.08.2026
Fish Audio
—индекс_ · ещё не замеренHanabi AIСША
Синтез речи от Hanabi AI: озвучивает текст моделью S2.1 Pro, клонирует голос по короткому образцу и размечает эмоции тегами прямо в тексте. Под продуктом открытые модели Fish Speech.
Факты
- Юрлицо — Hanabi AI Inc., корпорация по праву штата Делавэр, адрес 1111B S Governors Ave STE 48109, Dover, DE 19904; арбитраж — в округе Сан-Франциско по праву Калифорнии (fish.audio/terms, срез 19.08.2026). Fish Audio — продуктовая площадка компании, OpenAudio — её исследовательская лаборатория. Основатель и CEO — Шицзя Ляо (Shijia Liao), автор открытых голосовых моделей So-VITS-SVC, GPT-SoVITS и Bert-VITS2.
- Модель OpenAudio S1 представлена 03.06.2025: обучена на более чем 2 млн часов аудио, поддерживает 13 языков, заняла первое место в TTS-Arena, показала 0,8% WER и 0,4% CER на Seed TTS Eval (fish.audio/blog/introducing-s1).
- Линейка API на 19.08.2026: s2.1-pro — рекомендованная продакшн-модель, s2.1-pro-free — та же модель за 0 $ для тестов и прототипов без гарантий по задержке, s2-pro и s1 — предыдущие поколения (docs.fish.audio).
- Открытый код: репозиторий fishaudio/fish-speech на GitHub — 32 264 звезды, последний коммит 03.08.2026 (GitHub API, срез 19.08.2026). Витрина продукта на ту же дату: синтез речи, распознавание, клонирование голоса по образцу от 15 секунд, Story Studio для аудиокниг, голосовые агенты и библиотека более 2 000 000 голосов.
Полная карточка готовится: вердикт «брать или нет», цены, доступ из РФ и сравнение с соседями появятся по мере прохождения фабрики карточек.