Oossa

ElevenLabs startet Sprachmodell v4 mit niedrigeren API-Preisen

Die neuen Stimmen v4 und v4 Turbo kosten 0,08 bzw. 0,04 US-Dollar pro 1.000 Zeichen. Bis zum 12. Oktober gelten Aktionspreise von 0,022 bzw. 0,011 US-Dollar.

Oossa1 Min. Lesezeit

ElevenLabs startet Sprachmodell v4 mit niedrigeren API-Preisen
Photo by Will Francis - AI & Marketing on Unsplash

ElevenLabs hat sein neuestes Text-to-Speech-Modell Eleven v4 sowie eine Echtzeitvariante namens v4 Turbo angekündigt. Laut Unternehmen klingen die neuen Stimmen ausdrucksstärker und können den Tonfall einer Figur auch über lange Skripte hinweg konsistent halten. Beide Modelle sind ab sofort über die Plattform ElevenAgents, die App ElevenCreative und die öffentliche API verfügbar.

Was ist neu und wie viel kostet es?

Eleven v4 kann bis zu 10.000 Zeichen in einer einzelnen Anfrage verarbeiten – das entspricht etwa zehn Minuten Audio – und unterstützt mehr als 90 Sprachen. Beim Vorgängermodell v3 waren es rund 70. Die Turbo-Version ist für Sprachagenten ausgelegt und kann nach etwa 150 ms mit dem Sprechen beginnen. Das ist deutlich schneller als die 262 ms, die das Unternehmen bei einem Wettbewerber gemessen hat.

Bei der API-Nutzung kostet das Standardmodell v4 0,08 US-Dollar pro 1.000 Zeichen (80 US-Dollar pro Million Zeichen), v4 Turbo 0,04 US-Dollar pro 1.000 Zeichen (40 US-Dollar pro Million). Bis zum 12. Oktober sind die Preise auf 0,022 bzw. 0,011 US-Dollar pro 1.000 Zeichen reduziert.

Warum das für Kreative wichtig ist

Die niedrigeren Preise und die schnellere Reaktion von Turbo machen hochwertige, ausdrucksstarke KI-Stimmen für unabhängige Podcaster, Spieleentwickler und kleine Unternehmen erschwinglicher, die Sprachagenten in Echtzeit benötigen. Die höhere Zeichenbegrenzung verringert zudem die Notwendigkeit, lange Skripte aufzuteilen – das spart Zeit bei der Produktion von Hörbüchern oder Tutorials.

Warum es wichtig ist

Für alltägliche Nutzer bedeuten die niedrigeren Kosten pro Zeichen geringere Ausgaben bei Projekten mit vielen gesprochenen Inhalten. Mit dem schnelleren Turbo-Modell können Entwickler Sprachassistenten in Echtzeit bauen, die natürlich klingen und ohne spürbare Verzögerung reagieren.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.

Quellen und Referenzen

#QuelleMediumDatumKernaussage
1ElevenLabs' new v4 speech model makes AI voices more expressive and consistent ↗The Decoder29.09.2026Elevenlabs' new speech model, Eleven v4, follows cues for laughter and whispering more accurately and keeps voices consistent across long productions like audiobooks.

1 Quellen

Zuletzt aktualisiert: ·Markdown·llms.txt