./thesis / trust
信頼できるAI.
企業がAIエージェントに本物の仕事を任せるのは、エージェントが何をしたかを証明できるようになった日です。要約ではなく、証明です。
ログは証明ではない
今日のAIシステムはすべてログを残します。しかしログはデータベース上のテキストであり、テキストは編集も削除も静かな紛失も可能です。エージェントが返金を承認し、候補者を不採用にし、送金を実行したとき、「ログがあります」は規制当局にも顧客にも裁判所にも通用しません。求められる水準は改ざん検知性です。事後に書き換えれば、その書き換えが必ず露呈する記録です。
判断は一瞬ではなく連鎖である
エージェントの行動は連鎖の最後の環です。見たデータ、与えられたコンテキスト、呼び出したモデル、触れたツール、途中のステップ。どの環が欠けても、その行動は説明不能になります。監査の単位は連鎖全体であるべきだと私たちは考えます。発生と同時に捕捉し、ハッシュ化して封印し、後からすべてのステップを再生・検証できるようにするのです。
モデルが何を考えたかは証明できない
クローズドなモデルは重みを公開しておらず、どんな暗号技術もそれを変えられません。誠実で、かつ有用な主張は別のところにあります。何が入力され、何が出力され、それで何が行われたか、そして判断に対する分析が記録に忠実であることは証明できるのです。それで重要な問いには答えられます。誰が、何に基づいて判断し、それを検証できるか。
規制はツールより速く到来する
まさにこの種の記録を要求する規則が、EU、米国、その他の地域で既に予定されており、罰則は取締役会の議題を変えるほどの規模です。ほとんどの企業はその波をスクリーンショットと善意で迎えるでしょう。エージェントを大規模に運用する企業には、そのために設計された信頼インフラが必要です。私たちがこのレイヤーを最初に作るのは、これなしには他のすべてが意味を持たないからです。