Eleven v3 Audio Tags: Regissera karaktärers uttryck i tal
- Skriven av
- Ryan Morrison
- Publicerad
- Senast uppdaterad
LyssnaLyssna på den här artikeln
Audio Tags är ett kraftfullt verktyg i Eleven v3 (alpha), vår nya förhandsversion för forskning av modellen Text to Speech från ElevenLabs. Med dem kan du styra inte bara ton och tempo, utan även karaktär och röstprestation.
Med taggar som [pirate voice], [French accent] eller [sarcastically] blir rösten ett verktyg för berättande, inte bara uppläsning. Kombinera dem med en stark Voice Clone för en karaktär, så fångar du inte bara ett ljud utan en hel prestation.
Med de här taggarna kan du byta röstidentitet mitt i en replik, efterlikna accenter eller använda arketyper som skurkar, berättare och sidekicks — utan att ändra manuset eller byta röst.
Vad är karaktärsprestation i AI-tal?

Karaktärsprestation är förmågan att kliva in i en roll. Oavsett om du ger röst åt en flamboyant skurk, en barsk sjökapten eller en lokal butiksägare från Melbourne låter de nya Audio Tags dig styra framförandet så att det passar den persona du vill förmedla.
Med en enkel fras inom hakparenteser kan du sätta scenen: ”[pirate voice] Arr, det öppna havet. Känner ni doften, grabbar? Det är frihetens doft … och bara en aning myteri.”
Modellen uttalar inte bara orden — den framför dem i rollen.
Från accent till arketyp
Röstprestation handlar inte bara om volym eller känsla. Det handlar också om vem som talar. Med Eleven v3 kan du direkt ange specifika accenter, dialekter och talstilar. Till exempel:
[American accent] Kunde du byta min accent i den gamla modellen? [dismissive] Tänkte väl det. [Australian accent] Men det kan du nu — kolla här, kompis! [French accent] Min kärlek … äär som en röd, röd ros.
Den här typen av smidiga identitetsbyten passar perfekt för animation, spel, interaktiv fiktion eller alla situationer där talarens personlighet spelar roll.
Vanliga taggar för karaktärsprestation
Karaktärsinriktade taggar låter dig forma röstens identitet och närvaro:
- Accenter och dialekter: [British accent], [Australian accent], [Southern US accent]
- Arketyper och roller: [pirate voice], [evil scientist voice], [childlike tone]
- Talstilar: [dramatic], [sarcastically], [matter-of-fact], [whiny]
- Genresignaler: [fantasy narrator], [sci-fi AI voice], [classic film noir]
Genom att kombinera taggar kan du väcka karaktärer till liv: ”[dramatic][French accent] Du förstår inte ... zis handlade aldrig om hämnd. Det handlade om ödet.”
Från berättare till ensemble
I manus med flera karaktärer gör Audio Tags det enkelt att växla mellan röster. Skapa spänning, humor eller överraskning genom att bara byta karaktärsprestation mitt i dialogen — utan extra redigering.
Ta det här utdraget från en demo: ”Jessica: [laughs] Det var ... vackert. Dr. Von Fusion: [dramatic] Att vara eller inte vara — det är frågan! Jessica: [French accent] Det här är spektakulärt, eller hur?”
Det som tidigare krävde en hel ensemble kan nu skrivas för ett enda röstspår — utan att ge avkall på omfång eller djup.
Regissera röster, inte bara skriv repliker
Eleven v3 stöder dynamiska röstförändringar, kontextuella skiften och konsekvent framförande mellan karaktärer. Det innebär att modellen inte bara förstår vad som ska sägas — utan hur varje karaktär ska säga det.
För kreatörer öppnar det här en ny nivå av kontroll. Du skriver inte bara dialog. Du regisserar prestationer.
Välj rätt röst
Professional Voice Clones (PVC) är för närvarande inte helt optimerade för Eleven v3, vilket kan ge lägre klonkvalitet jämfört med tidigare modeller. Under den här forskningsförhandsvisningen rekommenderar vi att du väljer en Instant Voice Clone (IVC) eller en designad röst för ditt projekt om du behöver använda v3-funktioner. Optimering av PVC för v3 kommer inom kort.


