Hoppa till navigering

Voice Changer

Lär dig hur du omvandlar ljud mellan röster och samtidigt bevarar känsla och framförande.

Översikt

ElevenLabs Voice Changer-API låter dig omvandla källjud (inspelat eller uppladdat) till en annan, helt klonad röst utan att förlora originalets nyanser i framförandet. Den kan fånga viskningar, skratt, gråt, accenter och subtila känslomässiga signaler för ett mycket realistiskt, mänskligt resultat och kan användas för att:

  • Ändra vilken röst som helst samtidigt som känslomässigt framförande och nyanser bevaras
  • Skapa konsekventa karaktärsröster på flera språk och under flera inspelningstillfällen
  • Rätta eller ersätta specifika ord och fraser i befintliga inspelningar

Utforska vårt röstbibliotek för att hitta den perfekta rösten för ditt projekt.

Språk som stöds

Våra flerspråkiga v2-modeller har stöd för 29 språk:

Engelska (USA, Storbritannien, Australien, Kanada), japanska, kinesiska, tyska, hindi, franska (Frankrike, Kanada), koreanska, portugisiska (Brasilien, Portugal), italienska, spanska (Spanien, Mexiko), indonesiska, nederländska, turkiska, filippinska, polska, svenska, bulgariska, rumänska, arabiska (Saudiarabien, Förenade Arabemiraten), tjeckiska, grekiska, finska, kroatiska, malajiska, slovakiska, danska, tamil, ukrainska och ryska.

Modellen eleven_english_sts_v2 stöder endast engelska.

Viktiga fakta

  • Maximal segmentlängd: 5 minuter — dela upp längre inspelningar i delar
  • Debitering: 1 000 tecken per minut bearbetat ljud
  • Bakgrundsbrus: Använd remove_background_noise=true för att minimera omgivningsljud i utdata
  • Modellrekommendation: eleven_multilingual_sts_v2 presterar ofta bättre än eleven_english_sts_v2, även för innehåll på engelska
  • Anpassade röster: Alla klonade eller designade röster i ditt bibliotek kan användas som utdata-röst; ange dess voice_id