Oossa

ElevenLabs lancia il modello vocale v4: API meno care e Turbo più veloce

Le nuove voci v4 e v4 Turbo costano rispettivamente 0,08 e 0,04 dollari ogni 1.000 caratteri. Fino al 12 ottobre, prezzo promozionale di 0,022 e 0,011 dollari.

Oossa1 min di lettura

ElevenLabs lancia il modello vocale v4: API meno care e Turbo più veloce
Photo by Will Francis - AI & Marketing on Unsplash

ElevenLabs ha annunciato il suo ultimo modello di sintesi vocale, Eleven v4, e una variante in tempo reale chiamata v4 Turbo. L’azienda afferma che le nuove voci sono più espressive e mantengono coerente il tono di un personaggio anche nei copioni più lunghi. Entrambi i modelli sono già disponibili tramite la piattaforma ElevenAgents, l’app ElevenCreative e l’API pubblica.

Novità e prezzi

Eleven v4 può elaborare fino a 10.000 caratteri in una singola richiesta, pari a circa dieci minuti di audio, e supporta più di 90 lingue, rispetto alle circa 70 del precedente modello v3. La versione Turbo è progettata per gli agenti vocali e può iniziare a parlare in circa 150 ms: un miglioramento significativo rispetto ai 262 ms misurati dall’azienda per un concorrente.

Per l’uso dell’API, il modello v4 standard costa 0,08 dollari ogni 1.000 caratteri (80 dollari per milione di caratteri), mentre v4 Turbo costa 0,04 dollari ogni 1.000 caratteri (40 dollari per milione). Fino al 12 ottobre, le tariffe promozionali sono rispettivamente di 0,022 e 0,011 dollari ogni 1.000 caratteri.

Perché interessa ai creator

I prezzi più bassi e la risposta più rapida di Turbo rendono le voci AI di alta qualità ed espressive più accessibili a podcaster indipendenti, sviluppatori di videogiochi e piccole imprese che hanno bisogno di agenti vocali in tempo reale. Il limite più alto di caratteri riduce inoltre la necessità di dividere i copioni lunghi, facendo risparmiare tempo nella produzione di audiolibri o tutorial.

Perché conta

Per gli utenti comuni, il costo inferiore per carattere si traduce in spese più basse per i progetti che richiedono molti contenuti parlati. Il modello Turbo più rapido consente agli sviluppatori di creare assistenti vocali in tempo reale dal suono naturale e senza ritardi percepibili.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.

Fonti e riferimenti

#FonteTestataDataPunto chiave
1ElevenLabs' new v4 speech model makes AI voices more expressive and consistent ↗The Decoder29 set 2026Elevenlabs' new speech model, Eleven v4, follows cues for laughter and whispering more accurately and keeps voices consistent across long productions like audiobooks.

1 fonti

Ultimo aggiornamento: ·Markdown·llms.txt