Cambiador de Voz

Aprende a transformar audio entre voces conservando la emoción y la entonación.

Descripción general

La API de cambiador de voz de ElevenLabs te permite transformar cualquier audio de origen (grabado o subido) en una voz diferente y totalmente clonada sin perder los matices de la interpretación original. Puede captar susurros, risas, llantos, acentos y sutiles señales emocionales para lograr un resultado muy realista y humano, y puedes usarla para:

  • Cambiar cualquier voz conservando la entonación emocional y los matices
  • Crear voces de personaje consistentes en varios idiomas y sesiones de grabación
  • Corregir o sustituir palabras y frases concretas en grabaciones existentes

Explora nuestra biblioteca de voces para encontrar la voz perfecta para tu proyecto.

Idiomas compatibles

Nuestros modelos multilingües v2 son compatibles con 29 idiomas:

Inglés (EE. UU., Reino Unido, Australia, Canadá), japonés, chino, alemán, hindi, francés (Francia, Canadá), coreano, portugués (Brasil, Portugal), italiano, español (España, México), indonesio, neerlandés, turco, filipino, polaco, sueco, búlgaro, rumano, árabe (Arabia Saudí, EAU), checo, griego, finés, croata, malayo, eslovaco, danés, tamil, ucraniano y ruso.

El modelo eleven_english_sts_v2 solo admite inglés.

Datos clave

  • Duración máxima del segmento: 5 minutos; divide las grabaciones más largas en fragmentos
  • Facturación: 1000 caracteres por minuto de audio procesado
  • Ruido de fondo: Usa remove_background_noise=true para minimizar los sonidos ambientales en el resultado
  • Recomendación de modelo: eleven_multilingual_sts_v2 suele superar a eleven_english_sts_v2 incluso para contenido en inglés
  • Voces personalizadas: Puedes usar como voz de salida cualquier voz clonada o diseñada de tu biblioteca; proporciona su voice_id