** Production-grade voice AI — Text-to-Speech, Voice Cloning, Speech-to-Text (Transcribe)
| Модель | Тип | Цена |
|---|---|---|
| S2.1 Pro | TTS | Мультимодальная, мультиязычная, выразительная, long-form, multi-speaker, multi-turn, ultra-low latency |
| S2 | TTS | Мультиязычная, controllable, expressive, multi-speaker |
| S1 | TTS | Базовая TTS |
| Transcribe 1 | STT | Speech-to-Text транскрипция |
| Voice Cloning | TTS | Клонирование голоса |
| Free Tier | $0 | Базовый доступ |
| План | Цена | Особенности |
|---|---|---|
| S2.1 Pro | TTS | Free via API (model `s2.1-pro-free`) |
| S2 | TTS | $15/1M UTF-8 bytes |
| S1 | TTS | $15/1M UTF-8 bytes ($0.36/hour) |
| Transcribe 1 | STT | $15/1M UTF-8 bytes |
| Free Tier | $0 | — |
| ✅ Преимущества | ❌ Недостатки |
|---|---|
|
|
Через российский агрегатор — он берёт на себя оплату и обращение к зарубежному API. VPN и зарубежная карта не нужны.
У многих моделей есть бесплатный доступ с лимитами. Для регулярной работы обычно нужен платный тариф.
Прогоните один и тот же типовой промпт через несколько моделей и сравните результат — это точнее любых бенчмарков.
Все нейросети в одной подписке. Вместо отдельной оплаты каждого сервиса можно подключить агрегатор STIVA.ai — 80+ моделей: текст, изображения, видео и аудио. Оплата картой МИР и через СБП, без VPN.