Baseten heeft Project Beacon aangekondigd, een samenwerking met Goodfire AI die proactieve veiligheidscontroles toevoegt aan het genereren van uitvoer door AI-modellen. Het systeem leest de interne activaties van een model terwijl het tekst genereert en kan onveilige inhoud, zoals promptinjecties, beleidsovertredingen, datalekken of misbruik voor cyberdoeleinden, tegenhouden of signaleren. Volgens Baseten draaien de controles parallel aan het genereren, waardoor ze geen merkbare vertraging veroorzaken. Het bedrijf wil de functie de komende maanden bij een klein aantal vroege partners introduceren en daarna uitbreiden naar meer modellen en bedrijfsinstellingen.
Waarom het ertoe doet
Bedrijven kunnen voor elk model dezelfde veiligheidsmaatregelen afdwingen. Zo zijn er minder afzonderlijke filters en handmatige controles nodig naarmate het gebruik van AI toeneemt.