Baseten은 AI 모델 추론 과정에 선제적 안전 점검 기능을 추가하는 Goodfire AI와의 협력 프로젝트 ‘Project Beacon’을 발표했다. 이 시스템은 모델이 텍스트를 생성하는 동안 내부 활성화 값을 읽고, 프롬프트 인젝션, 정책 위반, 데이터 유출, 사이버 악용과 같은 안전하지 않은 콘텐츠를 차단하거나 표시할 수 있다. Baseten은 모니터링 기능이 텍스트 생성과 병렬로 실행돼 체감할 만한 지연을 유발하지 않을 것이라고 밝혔다. 앞으로 몇 달 동안 일부 초기 파트너에게 이 기능을 제공한 뒤, 지원 모델과 기업용 제어 기능을 확대할 계획이다.
왜 중요한가
기업은 모델마다 별도의 필터와 수동 검토 절차를 마련할 필요를 줄이면서, AI 활용이 늘어나는 상황에서도 모든 모델에 일관된 안전장치를 적용할 수 있다.