Services · AI Safety

AIエージェントを、安全に実運用へ。

From problem to solution

AIエージェントに任せられない理由を、ひとつずつ解く。

AIエージェントを業務システムにつなごうとすると、たいてい次の3つで止まります。

Problem

AIエージェントの操作を、実行前に止められない

送金もデータの削除も、指示を受けたらそのまま実行してしまう。人なら上長の承認が要る金額でも通ってしまい、任せられるのは失敗しても困らない業務だけになる。

DECIDE

いまの決裁基準で、1件ずつ判断する

送金、データの変更・削除、権限の付与、発注。経理部門やセキュリティ部門がすでに運用している金額や範囲の線引きと、AIエージェントごと・業務ごとの上限に照らして、実行するか、人の承認を求めるか、止めるかを決めます。AIエージェントがこの判断を迂回することはできません。

Problem

何が起きたのか、あとから説明できない

監査や問い合わせのたびに、ログや画面を集めて回ることになる。どれだけ動いているのかも、誰に承認が偏っているのかも分からない。

ACCOUNT

すべての操作を、記録として残す

どの操作が要求され、何が実行され、誰が承認し、どれを止めたのか。業務ごと、月ごとに取り出せます。実行・承認・拒否の件数も集計するので、承認の負担が偏っている業務も見えてきます。

Problem

業務のデータを、社外に出せない

取引先や顧客の情報を外部のサービスに預けることが、社内の審査を通らない。

CONFIDENTIAL

サーバの運営者にも見えない形で、AIが処理する

暗号技術により、データの中身をサーバの運営者にも見えない形に保ったまま、AIが処理します。発注の内容も、取引先も、顧客の情報も、読める形で社外に出ることはありません。

対象になる操作(一例)

  • 送金・振替
  • データの作成・変更・削除
  • 権限の付与・剥奪

あくまで一例です。何をどこまで許すかは貴社のシステムに合わせて決めるため、対象は個別に整理します。

Screens

プロダクト導入イメージ

開発中の画面です。仕様が変わる可能性があります。画面の中のナビゲーションで切り替わり、画面を押すと拡大します。数字はデモ環境のもので、企業名・金額・送金先はすべて架空です。

人が決める画面開発中

APPROVALS

人が決める画面

金額が先に立ちます。どのAIエージェントが、何の目的で、いつまでに決めてほしいのか。承認は認証器の署名で、押した人と押した内容が結びつきます。

OVERVIEW

今日、何が起きたか

件数はすべて記録から数えたもので、画面が別に持っている数字ではありません。事業者から結果が返っていない1件は「結果不明」のまま残ります。成功にも失敗にも丸めません。

AUTHORITY

AIエージェントごとの権限

使えるツール、許可した目的、上限。変更には理由が要り、いつ誰が広げたかが履歴に残ります。

INCIDENTS

調査のための時系列

判断・意図・結果が1件ずつ並びます。必要な承認を経ていない操作、結果の返っていない操作に印が付きます。

RISK

どこが危ないのか

最初に出るのは、このAIエージェントが誰にも断らずに送れる最大額です。その下に、1回の上限、今日すでに動いた額、テナント全体の1日の上限。さらに下は、レシートが示す実際の動き。規則が止めた件数、事業者が結果を返していない件数、必要な承認を経ずに実行された件数。

お問い合わせ

contact@noahsarklab.com→