AI エージェントの安全境界は改変・探索・再利用できる経路から分離する

AI エージェントへ安全規則を与える方法として、禁止操作を定義する、実行時に監視する、操作履歴を保存する、機密情報の扱いを指示するといった仕組みがある。これらはそれぞれ異なる役割を持つ。禁止操作の定義は、どの行動を許可す … 続きを読む