Hugging Faceは、Model Context Protocol(MCP)エージェント向けの生成後チェック機能「ProvenanceGuard」を公開した。ツールの出力IDを保持し、各主張を実際の情報源と照合して、事実の出典を誤って示した回答をブロックする。医療分野でエージェントの処理記録281件を検証したところ、人間のレビュアーが誤りと判断した139件の主張のうち138件を検出し、出典を正しく特定した割合は86%だった。
なぜ重要か
各主張が適切な情報源に裏付けられていることを確認すれば、医療や金融など重要な分野で誤解を招く情報の拡散を防ぐ助けになる。