AlphaSense hat bekannt gegeben, dass die Generative Search jetzt auf den schnellen Inferenzchips von Cerebras läuft. Durch die Partnerschaft sinkt die Zeit bis zum ersten Token um 88 Prozent – von 19,5 Sekunden auf 2,3 Sekunden. So kann das System erste Antworten in nur 10–20 Sekunden liefern. Dank der schnelleren Modellabfragen kann AlphaSense den mehrstufigen Rechercheablauf mit Planung, Weiterleitung und Bewertung von Textausschnitten beibehalten, ohne dass die Nutzung an Interaktivität verliert.
Warum es wichtig ist
Analysten erhalten fundierte Antworten innerhalb von Minuten statt Stunden und können so schneller an Telefonkonferenzen zu Geschäftszahlen und Marktrecherchen weiterarbeiten.