Baseten объявила о запуске Project Beacon — совместного проекта с Goodfire AI, который добавляет проактивные проверки безопасности при обработке запросов ИИ-моделями. Система анализирует внутренние активации модели во время генерации текста и может блокировать или помечать небезопасный контент, например попытки внедрения промптов, нарушения политик, утечки данных или использование ИИ для киберпреступлений. По словам Baseten, мониторы будут работать параллельно с генерацией и не станут заметно увеличивать задержку. Компания планирует в течение следующих нескольких месяцев подключить к функции несколько первых партнёров, а затем распространить её на большее число моделей и корпоративных инструментов управления.
Почему это важно
Компании смогут применять единые меры безопасности к любым моделям, сокращая потребность в отдельных фильтрах и ручной проверке по мере расширения использования ИИ.