Cloná, diseñá y generá voces con IA, en español y muchos idiomas más. Grabá 10 segundos y replicá tu voz en segundos. Sin estudio, sin GPU.
Voces reales pre-generadas con Kyma · escuchá la onda en vivo
Grabá 10 segundos de audio limpio y replicá tu voz, en español y muchos idiomas más.
Ajustá tono, edad y carácter. Creá una identidad sonora desde cero, sin grabar nada.
Latencia baja: generás tu audio en segundos, listo para descargar o integrar.
Español, inglés, portugués, francés, italiano, alemán, chino, japonés y muchos más.
Integrá Kyma en tu producto con un solo endpoint. Disponible en el plan Pro.
Caracteres, latencia y uso, monitoreados en tiempo real desde tu dashboard.
Una familia de productos, un solo nombre. Generá voz con IA en español y muchos idiomas más.
Texto a voz para locución, voiceover y audiolibros, multilenguaje.
Cloná tu voz con 10 segundos de audio limpio.
Diseñá una voz desde cero ajustando tono, edad y carácter.
Lector de voz: pegá un texto o artículo largo y escuchalo.
Doblaje IA: tu video en otro idioma, con tu propia voz.
Generá voz desde tu producto con una REST API (plan Pro).
Con 10 segundos de audio limpio alcanza para clonar tu voz. La transcribimos automáticamente.
Español y muchos idiomas más. Seleccioná el idioma destino y el carácter de la voz que querés generar.
En menos de un segundo tenés tu audio listo para usar, exportar o integrar por API.
Generá en español, inglés, portugués, francés y muchos idiomas más, cloná tu propia voz con 10 segundos de audio y diseñá voces desde cero — con una API lista para integrar y una relación precio/volumen muy competitiva.
| Comparativa | Kyma | ElevenLabs | Cartesia |
|---|---|---|---|
| Idiomas soportados | Multilenguaje | Decenas | Decenas |
| Precio · caracteres incluidos | $12 · 200k | $22 · 100k | $5 · 100k |
| Clonación de voz (10s) | |||
| Diseño de voz por atributos | Parcial | ||
| API REST + docs | |||
| Doblaje IA | Pronto |
Datos de otras plataformas aproximados, según sus planes de entrada públicos (sujetos a cambios). Soporte multilenguaje vía el modelo OmniVoice.
Para probar y proyectos personales.
Incluye:
Para creadores que producen seguido.
Todo lo de Gratis, más:
Para desarrollo y alto volumen.
Todo lo de Creator, más:
| Función | Gratis | Creator | Pro |
|---|---|---|---|
| Generación | |||
| Caracteres / mes | 10.000 | 200.000 | 1.000.000 |
| Idiomas | Multilenguaje | Multilenguaje | Multilenguaje |
| Generación en <1s | |||
| Diseño de voz por atributos | |||
| Clonación de voz (10s) | |||
| Voces guardadas reutilizables | |||
| Uso y entrega | |||
| Audios sin marca de agua | — | ||
| Licencia de uso comercial | — | ||
| Masterizado de audio (EQ + loudness) | — | ||
| API e integración | |||
| API REST + documentación | — | — | |
| Rate limit | — | — | 30 req/min |
| Soporte | Comunidad | Prioritario | |
Solo para uso responsable y con consentimiento de las voces clonadas.
Es uno solo: cada plan incluye una cantidad de caracteres por mes (10.000 / 200.000 / 1.000.000) que se usan tanto en la web como en la API — el mismo pool para todo, sin créditos separados por función. Si necesitás más, podés sumar packs de caracteres extra que no vencen.
No. Tenés 10.000 caracteres por mes gratis, sin tarjeta ni compromiso.
No: podés clonar tu voz en cualquier plan. En el plan Gratis los audios llevan una marca de agua inaudible y son para uso personal; desde Creator quedan sin marca y con licencia de uso comercial.
No se corta de golpe: podés ver tu uso en tiempo real desde el dashboard (con aviso visual al acercarte al límite) y subir de plan o sumar un pack de caracteres cuando quieras. El cupo mensual se renueva cada mes.
La API REST es exclusiva del plan Pro. Consume del mismo pool mensual de caracteres y tiene un límite de 30 requests por minuto por key.
Es un retoque opcional (EQ + loudness a -16 LUFS) que mejora la locución. Está incluido en los planes pagos (Creator y Pro), es opt-in —elegís qué audios masterizar— y no consume créditos aparte.
Sí, sin permanencia. Mantenés el plan hasta el final del período que ya pagaste.
Cualquier voz. Cualquier idioma. En segundos.