ガードレールとは

ガードレールは、AIへの入力とAIからの出力、およびエージェントの行動を検査して、機密情報の漏えい・不適切な内容・危険な操作を止める仕組みです。入力の検査(プロンプトインジェクションの検出)、出力の検査(個人情報のマスキング)、行動の制限(許可された操作だけ)を組み合わせます。