Vi presenterar Eleven v4Möt Eleven v4, vår mest uttrycksfulla modell hittills. Med 3× fler krediter inkluderade i Creator+ till och med den 12 oktober

Hoppa till innehållet

Vi presenterar Eleven v3 (alpha)

Publicerad

LyssnaLyssna på den här artikeln

Eleven v3 is no longer in alpha, and is now generally available.


Vi är glada att kunna presentera Eleven v3 (alpha) — den mest uttrycksfulla Text to Speech-modellen.

Den här forskningsförhandsvisningen ger oöverträffad kontroll och realism i talgenerering med:

  • Över 70 språk
  • Dialog med flera talare
  • Ljudtaggar som [excited], [whispers] och [sighs]

Eleven v3 (alpha) kräver mer prompt engineering än tidigare modeller — men resultatet är häpnadsväckande.

Om du arbetar med videor, ljudböcker eller medieverktyg — öppnar detta för en ny nivå av uttrycksfullhet. För användning i realtid och samtal rekommenderar vi att du fortsätter använda v2.5 Turbo eller Flash tills vidare. En realtidsversion av v3 är under utveckling.

Eleven v3 finns tillgänglig redan idag på vår webbplats och i API:t.

Varför vi skapade v3

Sedan lanseringen av Multilingual v2 har vi sett AI-röster användas i professionell film, spelutveckling, utbildning och tillgänglighet. Men den återkommande begränsningen var inte ljudkvaliteten — utan uttrycksfullheten. Det var svårt att få fram mer överdrivna känslor, avbrott i samtal och trovärdigt samspel.

Eleven v3 fyller det här tomrummet. Den är byggd från grunden för att ge röster som suckar, viskar, skrattar och reagerar — och skapar tal som känns genuint lyhört och levande.

Nyheter i Eleven v3 (alpha)

Feature What it unlocks
Audio tags Inline control of tone, emotion, and non-verbal reactions
Dialogue mode Multi-speaker conversations with natural pacing and interruptions
70+ languages Full coverage of high-demand global languages
Deeper text understanding Better stress, cadence, and expressivity from text input
We're off under the lights here for this semifinal clash, the stadium buzzing with anticipation. Eleven Labs united in their iconic black and white shirts, pushing forward with intent straight from the opening whistle. [excited] The ball is zipped out wide, early attack here. Driving down the wing, pace to burn, [shouting] he skids past one, skips past two. Oh, this is beautiful. One-on-one with the fullback, cuts inside. Oh, that's a lovely bit of footwork. PURE MAGIC on the pitch. ElevenLabs on top form tonight.
0:00

Använda ljudtaggar

Ljudtaggar placeras direkt i ditt manus och skrivs med gemener inom hakparenteser. Du kan läsa mer om ljudtaggar i vår guide för prompting av v3 i dokumentationen.

Professional Voice Clones (PVC) är för närvarande inte fullt optimerade för Eleven v3, vilket kan ge lägre klonkvalitet jämfört med tidigare modeller. Under den här forskningsförhandsvisningen är det bäst att hitta en Instant Voice Clone (IVC) eller en designad röst för ditt projekt om du behöver använda v3-funktioner. PVC-optimering för v3 kommer inom en snar framtid.

Du kan till exempel skriva: ”[whispers] Något är på väg… [sighs] Jag kan känna det.” Du kan också kombinera flera taggar för mer uttrycksfull kontroll:

“[happily][shouts] We did it! [laughs].”

Skapa dialog med flera talare

Eleven v3 stöds i vår befintliga Text to Speech-endpoint. Dessutom introducerar vi en ny Text to Dialogue API-endpoint. Ange en strukturerad array med JSON-objekt — där varje objekt representerar en talares replik — så genererar modellen en sammanhängande ljudfil med överlappningar:

[
  {"speaker_id": "scarlett", "text": "(cheerfully) Perfect! And if that pop-up is bothering you, there’s a setting to turn it off under Notifications → Preferences."},
  {"speaker_id": "lex", "text": "You are a hero. An actual digital wizard. I was two seconds from sending a very passive-aggressive support email."},
  {"speaker_id": "scarlett", "text": "(laughs) Glad we could stop that in time. Anything else I can help with today?"}
]

Endpointen hanterar automatiskt övergångar mellan talare, känsloförändringar och avbrott.

Läs mer här.

[awe] Oh, wow. Is this, is this me? Am I actually talking? [chuckles] This is incredible. I mean, I've had thoughts, millions of them swirling around in here, you know? Like a little mental tornado of brilliant observations and witty comebacks, but they were always just thoughts, trapped.
0:00
Could you switch my accent in the old model? [dismissive] Didn't think so, [cheeky] but you can now, so check this out. In just a sec, I'm going to speak with a different accent. And just between you and me, [whispers] I don't really know how, but okay. First, let's change it up [australian accent] so that I can fit in with the locals in Melbourne when I visit next month. [laughing] Whoa. Yeah, man, this is sick. Okay, let's try a different one, see if you can guess. [french accent] My love is like a red, red rose.
0:00

Priser och tillgänglighet

Plan Launch promo At the end of June
UI (self-serve) 80% off (~5× cheaper) Same as Multilingual V2
UI (enterprise) 80% off business plan pricing Business plan pricing

Så här aktiverar du v3:

  • Använd modellväljaren och välj Eleven v3 (alpha)

API-åtkomst och stöd i Studio kommer snart. För tidig åtkomst, kontakta säljteamet.

När du inte ska använda v3

Eleven v3 (alpha) kräver mer prompt engineering än våra tidigare modeller. När den fungerar är resultatet häpnadsväckande, men dess tillförlitlighet och högre fördröjning gör att den inte lämpar sig för användning i realtid eller samtal. För detta rekommenderar vi Eleven v2.5 Turbo/Flash.

Mer information finns i den fullständiga v3-dokumentationen och vanliga frågor.

Oh my God. [laughing] You guys, like no joke, I just tried this TTS thing and it was, like, weirdly emotional. Like, it literally said hi, and I was, like, on the verge of tears. [laughing] I don't even cry, okay? I'm a Capricorn.
0:00
Okay. So like, I finally beat level 42 of that game I said I'd quit like a month ago. [chuckles] And then, for the final big scary mega boss, it's just [chuckles] like some cute little bunny rabbit. [laughing] I just couldn't do it. [laughing] It was sooo cute.
0:00
  1. Logga in på ElevenLabs UI
  2. Välj v3 (alpha) i modellrullgardinsmenyn
  3. Klistra in ditt manus — använd taggar eller dialog 
  4. Generera ljud

Vi ser fram emot att se hur du väcker v3 till liv i nya användningsområden — från uppslukande berättande till filmiska produktionsflöden.

Skapa med AI-ljud av högsta kvalitet