AlphaSense meddelade att Generative Search nu körs på Cerebras inferenschip med hög hastighet. Samarbetet minskar tiden till den första tokenen med 88 procent, från 19,5 sekunder till 2,3 sekunder, vilket gör att systemet kan leverera de första svaren på så lite som 10–20 sekunder. Snabbare modellkörningar gör att AlphaSense kan behålla sitt researchflöde i flera steg – planering, dirigering och utvärdering av utdrag – samtidigt som tjänsten känns interaktiv.
Varför det spelar roll
Analytiker kan få evidensbaserade svar på några minuter i stället för timmar, vilket gör att de snabbare kan arbeta vidare med analyser av telefonkonferenser om kvartalsrapporter och marknadsundersökningar.