AlphaSense ha annunciato che la sua Ricerca generativa ora utilizza i chip Cerebras ad alta velocità per l’inferenza. La collaborazione riduce dell’88% il tempo necessario per generare il primo token, passando da 19,5 secondi a 2,3 secondi, e permette al sistema di fornire le prime risposte in appena 10-20 secondi. Le chiamate più rapide ai modelli consentono ad AlphaSense di mantenere il flusso di ricerca in più fasi — pianificazione, instradamento e valutazione degli estratti — garantendo al contempo un’esperienza interattiva.
Perché conta
Gli analisti possono ottenere risposte basate su prove in pochi minuti anziché in ore, iterando più rapidamente sulle conference call sui risultati finanziari e sulle ricerche di mercato.