AlphaSense a annoncé que sa fonction Generative Search s’appuie désormais sur les puces Cerebras, conçues pour accélérer l’inférence. Ce partenariat réduit de 88 % le délai avant le premier jeton, qui passe de 19,5 secondes à 2,3 secondes, permettant au système de fournir une première réponse en seulement 10 à 20 secondes. La rapidité des appels de modèles permet à AlphaSense de conserver son processus de recherche en plusieurs étapes — planification, acheminement et évaluation des extraits — tout en offrant une expérience interactive.
Pourquoi c'est important
Les analystes peuvent obtenir en quelques minutes des réponses étayées par des éléments concrets, plutôt qu’en plusieurs heures, et avancer plus vite dans l’analyse des conférences téléphoniques sur les résultats et des marchés.