Vi presenterar Eleven v4Möt Eleven v4, vår mest uttrycksfulla modell hittills. Med 3× fler krediter inkluderade i Creator+ till och med den 12 oktober

Hoppa till innehållet

ElevenLabs släpper nya Voice AI-produkter och samlar in 80 miljoner USD i serie B

Publicerad

LyssnaLyssna på den här artikeln

  • ElevenLabs har tagit in en Series B-runda på 80 miljoner dollar som leds gemensamt av Andreessen Horowitz, Nat Friedman, Daniel Gross, med deltagande av Sequoia Capital, Smash Capital, SV Angel, BroadLight Capital och Credo Ventures för att stärka sin position som ledande inom röst-AI.
  • Företaget presenterar också i dag flera nya produkter, bland annat Dubbing Studio, Voice Library Marketplace, en förhandsversion av en Mobile Reader App samt nya modeller med förbättrad hastighet och språkstöd.
  • Sedan lanseringen har ElevenLabs teknik förbättrat tillgängligheten till innehåll globalt inom områden som kreatörsekonomin, publicering, Conversational AI, underhållning, utbildning och tillgänglighet. Att tekniken har fått miljontals användare har lett företaget till enhörningsstatus.

22 januari / Globalt – ElevenLabs, ett forskningsföretag inom röstteknik, har tagit in en Series B-runda på 80 miljoner dollar som leds gemensamt av Andreessen Horowitz, Nat Friedman, Daniel Gross, med deltagande av Sequoia Capital, SV Angel, Smash Capital, BroadLight Capital och Credo Ventures, för att befästa sin position som global ledare inom forskning och produktlansering för röst-AI.

Sedan den offentliga lanseringen har ElevenLabs varit ledande inom naturlig talsyntes och gjort det möjligt för användare att skapa och utforma AI-röster på en mängd språk och med många olika accenter, som kan förmedla ett brett spektrum av känslor och tonfall. Sedan lanseringen har ElevenLabs användare skapat mer än 100 år av ljud, samtidigt som företaget växte från 5 till 40 medarbetare. I dag används ElevenLabs teknik av medarbetare på 41 % av Fortune 500-företagen. 

ElevenLabs teknik har fått genomslag inom många branscher. Den har hjälpt kreatörer att förbättra publikupplevelser med voice-over och AI-dubbning, breddat tillgången till utbildning och erbjudit innovativa lösningar inom ljudboksutgivning, underhållning och privat användning, inklusive bättre tillgänglighet. Finansieringen ska användas för att vidareutveckla företagets produkter och samtidigt säkerställa en trygg användning av AI-teknik.

Utöver dagens besked om Series B presenterar ElevenLabs även flera nya produktnyheter som blir tillgängliga under de kommande veckorna:

  • Ett nytt Dubbing Studio-workflow gör det möjligt att dubba hela filmer samt skapa och redigera transkriptioner, översättningar och tidskoder, vilket ger större kontroll över innehållsproduktionen. Funktionerna kompletterar den befintliga AI-dubbningsfunktionen, som möjliggör automatiserad videolokalisering från början till slut på 29 språk.
  • En Voice Library Marketplace som erbjuder en säker plattform där användare kan tjäna pengar på AI-versioner av sina egna röster. Användare kan skapa sin professionella AI-röstkopia, verifiera den och dela den via Voice Library. När andra använder dessa verifierade röster får de ursprungliga skaparna ersättning. Användarna behåller alltid kontrollen över röstens tillgänglighet och ersättningsvillkor. Marketplace genererar redan intäkter för en liten grupp alfa-användare.
  • En förhandsversion av Mobile App Reader som omedelbart omvandlar text och URL:er till ljud, så att användare enklare kan ta del av innehåll i ett annat format när de är på språng. Som ett introduktionserbjudande blir appen gratis de första tre månaderna, och användare kan registrera sig för tidig åtkomst via en väntelista.

Under 2023 har ElevenLabs även utökat sin närvaro inom flera områden, bland annat publicering, spel, medier och konversationsbaserade tjänster, samt ingått B2B-partnerskap med stora mediehus, däribland:

  • Publicering: Storytel, The Washington Post, Rheinische Post, Curio
  • Conversational AI: FlowGPT, SimpleTalk AI, Ollang, VoiceDrop, Vana
  • Medier och underhållning: Wondershare Filmora, Futuri Media, TheSoul Publishing
  • Spel: Paradox Interactive, NetEase, Inworld AI

De senaste produktlanseringarna och partnerskapen följer en period då ElevenLabs kontinuerligt har utökat sin verktygsuppsättning, som helt bygger på egen forskning. Lanseringarna omfattar: Speech Synthesis för verklighetstrogen text-till-tal-konvertering, samt en Turbo-modell optimerad för låg latens; Voice Design och Voice Cloning för att skapa skräddarsydda röster; Speech to Speech för att omvandla en röst till en annan. Företaget lanserade även sitt branschledande AI Dubbing-verktyg, som automatiskt kan översätta ljud och video till 29 språk och samtidigt bevara den ursprungliga talarens röst och känslor. Företaget kommer också snart att utöka Turbo- och Speech to Speech-modellerna, som för närvarande finns på engelska, till fler språk. 

Med utgångspunkt i forskningen bakom dessa funktioner har ElevenLabs också arbetat med att utveckla avancerade verktyg för mer komplexa workflows, som Studio för publicering och Dubbing Studio för videolokalisering. Studio förenklar redigering, strukturering, navigering och skapande av längre innehåll för utgivare, och Dubbing Studio hjälper till att förbereda innehåll för en global publik genom att ge direkt kontroll över transkription, översättning och sekvensernas tidsinställning.

Företaget har också utvecklat community-inriktade produkter som Voice Library – en miljö för att dela AI-genererade röster. Voice Library var tidigare begränsad till att dela artificiella röster skapade med verktyget Voice Design, men låter nu användare dela sina egna verifierade röstkopior som skapats med Professional Voice Cloning som en del av den nyligen introducerade Voice Library Marketplace, och tjäna pengar när andra använder dem. För att säkerställa säkerheten och integriteten i Marketplace använder ElevenLabs sin Professional Voice Cloning-teknik för att skapa röstkopior med hög återgivningstrohet. Innan en röst delas måste användaren klara en Voice Captcha-verifiering genom att läsa upp en text inom en viss tidsram för att bekräfta att rösten matchar träningsproverna. Den här processen, tillsammans med ElevenLabs teams moderering och manuella godkännande, säkerställer att autentiska, användarverifierade röster delas och intäktsgenereras, vilket skapar en säkrare och mer pålitlig miljö.

En central prioritet för ElevenLabs är en säker och ansvarsfull utveckling av AI, med fokus på att möjliggöra identifiering så att allt AI-genererat innehåll tydligt kan kännas igen. Företaget lanserade en AI Speech Classifier förra året, ett verktyg som kan verifiera om ett ljudprov innehåller innehåll genererat av ElevenLabs. I år kommer företaget att förbättra Classifiers funktioner så att den omfattar fler röst-AI-modeller, samt samarbeta med andra distributionsplattformar för en bredare implementering. ElevenLabs utvecklar aktivt ytterligare skyddsåtgärder för att öka säkerheten i det offentliga rummet.

Med denna Series B-investering avser ElevenLabs att befästa sin position som global ledare inom forskning och produktlansering för röst-AI. Kapitalet ska användas för att driva forskningen framåt, bygga ut infrastrukturen, utveckla nya produkter för särskilda branscher och stärka säkerhetsåtgärderna för att säkerställa en ansvarsfull och etisk utveckling av AI-teknik.

Piotr Dąbkowski, CTO på ElevenLabs, tillägger:

”Vårt teams engagemang har redan haft en bestående inverkan på röst-AI. Den här nya finansieringen gör det möjligt för oss att ta oss an ännu större utmaningar och fokusera på att behålla vårt försprång inom forskning och produktutveckling.”

Mati Staniszewski avslutar:

”Vår ambition är densamma – att förändra hur vi interagerar med innehåll genom att riva språk- och kommunikationsbarriärer. Vi bygger banbrytande teknik för att göra innehåll tillgängligt på olika språk – och med olika röster – så att alla kan få tillgång till information och berättelser som är viktiga. Våra framsteg hittills är ett bevis på vårt engagerade team och våra investerare, och även om vår resa bara har börjat hjälper vi tillsammans till att forma framtidens tillgänglighet och kommunikation.”

Liknande artiklar

Skapa med AI-ljud av högsta kvalitet