AIモデルの仕組みを研究するスタートアップGoodfireは、2026年10月8日(木)、モデルを「内側から見る」監視ツールを公開した。このプローブは、モデルの出力を再処理するのではなく、内部の活性化信号を読み取る。Basetenの顧客は、監視するリスクと、自動で実行する対応を選べる。GoodfireがオープンモデルのKimi K3で行ったテストでは、1,500セッションの費用は約$51で、悪意のあるハッキングの試みを94%検知した。
なぜ重要か
オープンモデルを使う開発者は、性能への大きな影響を避けながら、低コストで安全性チェックを追加できる。