AI 모델의 작동 방식을 연구하는 스타트업 Goodfire가 2026년 10월 8일 목요일 ‘내부 신호 기반’ 모니터를 출시했다. 이 프로브는 모델의 출력을 다시 처리하는 대신 내부 활성화 값을 읽는다. Baseten 고객은 감시할 위험 요소와 자동으로 취할 대응 조치를 선택할 수 있다. Goodfire가 오픈 모델 Kimi K3로 자체 테스트한 결과, 1,500회 세션에 드는 비용은 약 $51이었고 악의적인 해킹 시도의 94%를 적발했다.
왜 중요한가
오픈 모델을 사용하는 개발자는 성능 저하를 크게 일으키지 않으면서 저렴한 안전 점검 기능을 추가할 수 있다.