1. 商業上の決定を定義する
最初の決定は、AI イニシアチブを容量として購入するか、成果物として購入するか、測定された結果として購入するか、またはそれらの構造のハイブリッドを通じて購入するかです。容量の価格設定では、ソフトウェア、モデル、インフラストラクチャ、または人へのアクセスに対して支払います。成果物の価格は、合意された実装成果に対して支払われます。結果の価格設定は、考慮事項の一部を顧客のビジネスにおける測定された変化に関連付けます。ハイブリッドは、独立してサポートされる価値に対する変動対価を留保しながら、避けられない配信コストに資金を提供できます。
商業的な選択は、結果の制御可能性に従う必要があります。成果報酬は、価値イベントが観察可能であり、ベースラインが測定できるほど安定しており、ベンダーがパフォーマンスに重大な影響を与えることができ、顧客が必要な補完的なアクションを実行できる場合に最も正当性を主張できます。成果がマクロ経済状況、顧客の裁量、複数のベンダー、または長くて不確実な因果関係に大きく依存する場合は、通常、固定料金の方が簡単です。
契約チームは、決定を一文で書く必要があります。組織は、指定された保護措置と許可された最大の経済的エクスポージャを条件として、定義された測定期間にわたって定義された結果を改善するために、定義された境界内で、定義された AI 対応の変更を検討しています。この文が、ビジネス ケース、作業明細書、測定スケジュールの制御範囲になります。
NIST は、統治、地図作成、測定、管理を中心とした AI リスク管理を組織しています。測定結果は継続的なリスク監視と対応に情報を提供する必要があると述べています。 [1] これは、商業上の支払いが遡及的な交渉ではなく、運用管理システムによって生成された証拠に依存する契約アーキテクチャをサポートします。
投資委員会は、目標成果、固定対価および変動対価、測定方法、リスク許容度、データの使用および停止条件を承認する必要があります。法的条件は、承認された経済設計に従う必要があります。測定設計が未解決のままである場合、両当事者は、客観的に決定された変動料金を提示することを避けるべきである。
2. 価値契約アーキテクチャを構築する
契約は、リンクされたスケジュールのセットとして組み立てられる必要があります。基本契約は、一般的な法的条件および商業条件を扱います。ユースケースのスケジュールでは、ワークフローと承認された目的が特定されます。測定スケジュールは、価値イベント、ベースライン、反事実、および計算を定義します。データのスケジュールは、アクセス、処理、保持、削除を管理します。サービス スケジュールにより、可用性、パフォーマンス、サポートが設定されます。責任スケジュールには、ベンダー、顧客、従業員の行動が記録されます。保証スケジュールでは、テスト、証拠、監査、およびインシデントの報告が定義されます。コマーシャルスケジュールでは、ゲインシェアのウォーターフォールとキャップが適用されます。
各スケジュールでは、同じ定義された用語とバージョン識別子を使用する必要があります。提供されるサービスは、取得データ、プロンプト、ポリシー、ソフトウェア オーケストレーション、人間によるレビュー、インフラストラクチャ、および下流の決定にも依存する可能性があるため、モデル名だけでは不十分です。契約したシステムは、所有者と変更履歴を持つバージョン管理された構成として識別される必要があります。
アーキテクチャでは義務と依存関係を区別する必要があります。ベンダーは、応答遅延とモデルの可用性を維持する義務がある場合があります。ベンダーは、顧客がタイムリーで合法的かつ代表的なデータを提供することに依存する場合があります。顧客は、許可されたユーザーをトレーニングし、人間によるレビュー制御を運用する義務を負う場合があります。測定された結果は、顧客の導入、プロセスの再設計、および管理上の決定によって異なる場合があります。これらの依存関係を記録すると、帰属と救済の信頼性が高まります。

オリジナルフレームワーク。法的構造、用語、および必要なスケジュールは、取引および適用法に適合させる必要があります。
| スケジュール | 核心的な質問 | 最低限の証拠 | 一次承認 |
|---|---|---|---|
| 使用事例 | どのシステムが、誰のために、どこで何を行うのか | プロセスマップ、対象ユーザー、使用禁止 | ビジネスおよびリスクオーナー |
| 測定 | どのような変化が価値としてカウントされるのか | メトリクスの定義、ベースライン、比較方法 | 財務と運営 |
| データ | どのような情報が使用される可能性があるか | データマップ、法的根拠、許可、保持 | データ所有者およびプライバシー責任者 |
| サービス | どのようなパフォーマンスを提供する必要があるか | 可用性、遅延、精度、サポート記録 | サービス所有者 |
| 保証 | 主張がどのように検証され、異議が申し立てられるか | テスト結果、ログ、モデルおよびコントロールのバージョン | 独立した保証所有者 |
| コマーシャル | 検証された値の割り当て方法 | ウォーターフォール、上限、除外、請求書 | 財務および認定署名者 |
オリジナルフレームワーク。資格のある弁護士は法的強制力のある文書構造を決定する必要があります。
3. 値イベントを定義する
価値イベントとは、システムの使用と経済的成果を結び付ける、観察可能な最小の出来事です。例としては、正しく解決された顧客リクエスト、重複支払いの防止、受け入れられたエンジニアリング設計、販売に変換された適格なリード、避けられない遅延なく出荷が完了したこと、承認された基準内で処理された請求などが挙げられます。生産性の向上やより良い意思決定などの広範な説明は、支払いに関しては十分に正確ではありません。
イベント定義では、単位、開始点、完了点、評価日、データ ソース、受け入れルール、および取消ルールを識別する必要があります。顧客のケースが 30 日以内に再開された場合、元の解決策を取り消す必要がある場合があります。予測されたメンテナンスイベントの後に検査で欠陥がないことが判明した場合、回避された費用の請求には、事前に合意された処理が必要です。契約には、重複、不完全、キャンセルされた例外的なイベントがどのように処理されるかを明記する必要があります。
経済的価値は、運用上のイベントを数段階上回る可能性があります。より迅速な提案が自動的に収益を生み出すわけではありません。予測誤差が低くなっても、在庫は自動的に減少しません。推奨が成功しても、顧客の行動が自動的に変わるわけではありません。測定スケジュールでは、システムの出力から従業員の行動、運用イベント、財務上の影響、および現金への影響までの因果関係の連鎖を描く必要があります。証拠と制御可能性が十分に強い場合には、支払いを付加することができます。
イベントには品質の境界も必要です。処理時間の短縮により、エラー、苦情、または手戻りが増加した場合、価値が失われる可能性があります。したがって、主要な指標は、精度、安全性、顧客の成果、従業員の作業負荷、プライバシー インシデント、下流損失などのガードレール指標と組み合わせる必要があります。重要なガードレール違反が発生すると、ヘッドライン メトリックが改善したとしても、値イベントは失敗します。
4. ベースラインツリーを構築する
ベースラインは、契約された介入がない場合に期待される結果です。実装前に証拠の階層を使用して定義する必要があります。利用可能な最高品質の方法は、同時のコントロール グループまたはランダム化されたロールアウトです。他の方法には、段階的導入、一致した単位、差異の差、期間前の要因から構築された予測、または合意された変更に合わせて調整された単純な過去の平均が含まれます。
世界銀行のガイダンスでは、反事実の問題について、介入がなければ同じユニットに何が起こっていたかを推定する必要があると説明しています。因果推論のための実験的および準実験的な方法について説明します。 [5] 商用契約で完全な研究設計が再現されることはめったにありませんが、同じ規律により、展開後のすべての改善が AI システムの影響とみなされるのを防ぐことができます。
ベースライン ツリーでは、優先される方法とフォールバックを指定する必要があります。治療母集団、比較母集団、前期間、測定期間、季節性、重要な外部変数、除外および最小サンプルを特定する必要があります。各支店は、誰がそれを有効化できるのか、および支払いへの影響がどのように計算されるのかを明記する必要があります。
履歴ベースラインには変更ルールが必要です。量、製品構成、賃金率、投入価格、規制、顧客の行動、買収、閉鎖、その他のプログラムによって、期待される結果が変わる可能性があります。当事者は、どの変数を正規化し、どの変数を通常のビジネスリスクの一部として残すかについて合意する必要があります。過度の正規化により、監査できないモデルが作成されます。正規化が不十分な場合は、無関係な改善に対してベンダーに報酬を与えたり、外部ショックに対してペナルティを与えたりする可能性があります。

オリジナルフレームワーク。方法の選択は、データ、運用の実現可能性、倫理、およびユースケースに依存します。
5. メトリクス定義とソース系統を凍結する
すべての支払い指標にはデータ ディクショナリが必要です。ビジネス定義、計算式、記録システム、抽出方法、所有者、更新頻度、許可される調整、四捨五入、欠落または遅れたデータの処理を記述する必要があります。定義では、メトリクスが運用イベント、会計金額、または現金の受け取りを表すかどうかも記録する必要があります。
AI サービスはそれ自体の測定に使用されるデータを変更できるため、リネージが重要になります。ケースを解決済みとして分類するシステムは、成功報酬が依存する解決ステータスを書き込むこともあります。測定設計では、顧客の確認、下流の完了、会計記録、または別個の制御システムなどの独立した証拠を保持する必要があります。自ら生成した証拠は計算を裏付けることができますが、操作やドリフトがもっともらしい場合には、それが唯一の決定要因であってはなりません。
当事者は、各測定期間のデータと計算バージョンを凍結する必要があります。修正は、管理された再記述プロセスを通じて可能である必要があります。ログでは、モデル、プロンプトまたはポリシーのバージョン、入力データセット、人間によるレビュー担当者、出力、最終的なアクション、およびその後の経済イベントを特定する必要があります。アクセスは、プライバシー、機密性、セキュリティ、特権の要件に従う必要があります。
GAO AI 説明責任フレームワークは、ガバナンス、データ、パフォーマンス、モニタリングに関する実践をグループ化し、管理者と評価者に質問を提供します。 [8] 契約上の証拠パックでは、承認された目的、信頼できるデータ、測定されたパフォーマンス、継続的な監視という 4 つの部分からなる同じロジックを使用できます。
6. データの権利と責任を割り当てる
データ スケジュールでは、顧客データ、ベンダー データ、ライセンス供与されたサードパーティ データ、従業員データ、顧客生成のフィードバック、システム ログ、プロンプト、出力、派生機能、モデルの改善を区別する必要があります。クラスごとに、所有権または許可された使用、アクセス、セキュリティ、場所、保持、削除、移植性、監査、および終了後の使用を定義します。
コントローラーとプロセッサーのラベルは、目的と手段に関する実際の決定を反映する必要があります。英国情報コミッショナー局は、契約で使用されるラベルに関係なく、個人データ処理の目的と手段を決定する組織が管理者であると述べています。また、AI サプライチェーン全体の役割を文書化し、書面による指示、セキュリティ対策、下請け業者の管理、契約終了時の処理および監査の権利を設定することも推奨しています。 [3] 適用される要件は管轄区域および活動によって異なります。
トレーニングと改善の権利を明示する必要があります。サービスを提供するためにデータを処理する権限は、ベンダーの別のモデル開発に同じデータを使用する権限を自動的に確立するものではありません。スケジュールでは、情報を集約、匿名化、または共有モデルの改善に使用できるかどうかを特定し、選択した治療に必要な証拠を定義する必要があります。
測定権は、最終料金と監査紛争を解決するのに十分な期間存続する必要があります。その期間は制限され、比例する必要があります。運営サービスの終了を中心に設計されたデータ保持条項により、支払いや規制対応に必要な証拠が誤って削除される可能性があります。両当事者は、削除義務と訴訟ホールド、監査窓口、最終和解を調和させる必要があります。
7. サービスレベルを価値に結び付ける
従来のサービス レベルでは、稼働時間、応答時間、サポートが測定されます。 AI 価値契約には、ユースケースにリンクされたパフォーマンスと制御レベルも必要です。システムに応じて、これらには、精度、リコール、エラーコスト、棄権率、エスカレーション品質、レイテンシ、スループット、堅牢性、セキュリティ、説明可能性、データの鮮度、人によるレビューのコンプライアンスが含まれる場合があります。
モデルレベルのメトリクスは、エンドツーエンドのサービス結果の代わりにすべきではありません。入力が古くなったり、ユーザーが出力を無視したり、統合が失敗したり、顧客の状況が変化したりすると、高いベンチマーク精度がビジネス パフォーマンスの低下と共存する可能性があります。サービス スケジュールでは、どの指標がベンダー管理、顧客管理、または共同管理されるかを特定する必要があります。
NIST の生成 AI プロファイルは、ガバナンス、コンテンツの出所、導入前テスト、およびインシデントの開示に重点を置いています。 [2] これらの規律は、受け入れテスト、来歴ログ、リリースゲート、およびインシデント義務に変換できます。契約では、改訂版が成果報酬に寄与する前に、再テストが必要な材料モデルまたはシステムの変更を特定する必要があります。
サービス障害は、合意されたメカニズムを通じて支払いに影響を与えるはずです。考えられる治療法には、影響を受けるイベントの除外、品質の減点、サービスクレジット、ゲインシェアの削減、治癒期間または終了の権利が含まれます。契約で明示的に規定されていない限り、同じ障害によって意図しない重複リカバリが発生してはなりません。責任、補償、およびサービスクレジットの規定は、商用ウォーターフォールと調整される必要があります。
| メトリッククラス | 定義例 | 証拠 | 契約効果 |
|---|---|---|---|
| 値イベント | 対象となるケースが完了し受理されました | ワークフローと下流システム | 総利益計算を開始します |
| 品質 | 定義された期間内での取り消しまたは実証済みの手戻り | ケース監査と顧客記録 | イベントを取り消すか、控除を適用します |
| 安全性 | 重大な危害または禁止された行為 | インシデントとレビューの記録 | 期間を除外し、エスカレーションをトリガーします |
| サービス | 可用性、遅延、容量 | 独立した監視 | サービスクレジットまたは料金の割引 |
| 採択 | 承認されたプロセスに従う承認されたユーザー | アクセスとワークフローのログ | 顧客の依存関係をテストする |
| コントロール | 必要な人間によるレビューが完了しました | レビュー記録とサンプルテスト | 支払い対象となる条件 |
オリジナルフレームワーク。しきい値は、ユースケースの証拠と承認されたリスク許容度によって裏付けられる必要があります。
8. 人間と組織の依存関係を定義する
AI の結果では、通常、作業の変更が必要になります。従業員は、出力の確認、データの修正、キューの再設計、顧客との会話の変更、または新しいパフォーマンス測定の受け入れが必要になる場合があります。管理者は、重複した管理を削除し、決定権と資金統合を修正する必要がある場合があります。これらのアクションは、想定されるものではなく、顧客の依存関係として特定される必要があります。
責任スケジュールには、責任のある役割、期限、証拠、および各依存関係の結果を指定する必要があります。結果は比例する必要があります。トレーニング期限を過ぎると、測定期間が延長される可能性があります。合意されたデータを提供できない場合、影響を受ける指標が一時停止される可能性があります。必要な安全管理を意図的に回避すると、イベントが不適格となり、インシデントガバナンスが引き起こされる可能性があります。
従業員のインセンティブは、契約した成果やガードレールと一致する必要があります。スループットに対してのみ料金を支払うと、表面的な完成を促す可能性があります。オーバーライドにペナルティを与えると、必要な人間の判断が抑制される可能性があります。運用設計では、正しいエスカレーション、証拠の質、持続可能な導入が報われる必要があります。雇用、相談、監視、差別の要件については、管轄区域ごとの検討が必要です。
顧客も価値を形成します。与信判断を迅速化するシステムは申請を増やす可能性があるが、説明や異議申し立てルートが弱ければ混乱を招く可能性がある。カスタマー サービス エージェントはケースをより迅速に解決し、顧客は後でケースを再開する可能性があります。測定スケジュールには、重要な場合には遅延または下流の指標を含める必要があります。
9. アトリビューションブリッジを構築する
帰属は観察された変化から始まり、契約でサポートされていない金額は削除されます。ブリッジでは、量、価格、構成、インフレ、季節性、ポリシー、人員配置、その他のテクノロジー、プロセスの再設計、ベンダーの貢献、顧客の貢献、品質の低下、および増分コストを特定する必要があります。各調整には、所有者、データ ソース、および承認ルールが必要です。
当事者は、あらゆる不確実性を裁量委員会の決定に転用することを避けるべきである。事前に合意された式は、入力が観察可能な場合に役立ちます。専門家の限定的な判断により、特殊な紛争に対処できます。共同統治機関は、金額制限内で文書化された例外的な調整を承認できます。この制限を超える重大な変更には、承認された修正が必要となるはずです。
帰属は相互作用を認識する必要があります。ベンダーのモデルは、顧客プロセスの再設計がなければ価値を生み出さない可能性がありますが、モデルがなければ再設計の価値は限られている可能性があります。交渉による割り当て係数は、因果関係の分離が現実的でない場合の共有寄与を反映することができます。係数は、結果が判明する前に固定するか、透明なルールから導き出す必要があります。
マーケティングステートメントは証拠と一貫性を保つ必要があります。米国証券取引委員会は、投資顧問による AI の使用に関する虚偽または誤解を招く記述に関して執行措置を講じました。 [7] 価値契約では、検証された内部利益、外部に伝達可能な主張、および規制された開示の間の明確な違いを維持する必要があります。
10. ゲインシェアウォーターフォールを設計する
ウォーターフォールは、合意された総利益測定から開始し、固定順序で項目を差し引く必要があります。典型的なシーケンスは、外部効果、サポートされていない帰属、反転と品質障害、顧客の運用コストの増加、必要なサードパーティのコスト、既に支払われたベンダーの固定料金、閾値利益、ゲインシェアとキャップです。税金と会計記入は、該当するアドバイスに従う必要があります。
契約では、指標全体での二重カウントを防止する必要があります。処理時間の短縮と従業員コストの削減は、同じ利益をもたらす可能性があります。収益増加と貢献利益の両方を調整せずにカウントすべきではありません。運転資本放出は経常利益とは異なるため、独自の扱いが必要です。
ゲインシェア層では、顧客の経済性を維持しながら、優れたパフォーマンスを得ることができます。最小しきい値を設定すると、顧客は実装コストと中断コストを最初に確実に回収できます。より高い特典レベルでベンダー シェアが低下している場合、より広範な組織活動が規模を推進していることがわかります。測定の不確実性が重大なままである場合、キャップは変動する考慮事項を制限することができます。
支払いのタイミングは証拠の成熟に従う必要があります。運用イベントは毎月測定されますが、反転、顧客からの請求、または現金回収は後で発生します。当事者は、暫定声明、保留、年次調整を使用できます。監査期間は、無期限の不確実性を生じさせることなく、合意された反転を観察するのに十分な長さである必要があります。

オリジナルイラストモデル。すべての金額は USD millionsであり、完全に仮説です。
| ステップ | 百万米ドル | 計算または処理 |
|---|---|---|
| 報告された総利益 | 4.20 | アトリビューションレビュー前に観察された変化 |
| 外部影響が少ない | 0.55 | 量、価格、市場の変化 |
| サポートされていない帰属が少なくなる | 0.42 | 十分な因果関係の証拠がない場合の利益 |
| 品質の減点が少ない | 0.25 | 反転、やり直し、ガードレールの故障 |
| 運用コストの増加が少ない | 0.60 | 統合、レビュー、インフラストラクチャ、サポート |
| 検証済みの純利益 | 2.38 | コマーシャルウォーターフォールに入る量 |
| ベンダーの成果の考慮 | 0.43 | しきい値後の仮説的な段階的ゲインシェア |
| 顧客が保有する特典 | 1.95 | 検証済みの純利益からベンダーの成果を考慮したもの |
オリジナルイラストモデル。この値は組織を表すものではないため、ベンチマークとしては不適切です。
11. 仮説の経済学をテストする
この図では、年間のアドレス可能なコストベースが USD 20.0 million であると仮定しています。ベースラインは導入前に凍結され、合意された量と賃金率の動きに合わせて調整されます。測定期間では、USD 4.20 million の大幅な改善が報告されます。これはアドレス可能なベースの 21.0 パーセントに相当しますが、このパーセントはアトリビューション ブリッジが完了するまで検証された値として扱われません。
外部効果は USD 0.55 million を占めます。 USD 0.42 million のアトリビューション アカウントがサポートされていません。逆転と品質障害により、USD 0.25 million が削除されます。インフラストラクチャ、統合、保証、人間によるレビューの増分コストは USD 0.60 million です。したがって、検証された純利益は USD 2.38 million となります。
仮説上のゲインシェアにより、検証済みの純利益の最初の USD 0.50 million が顧客に与えられます。ベンダーは、次の USD 1.50 million の 25 パーセントと、USD 2.00 million を超える特典の 15 パーセントを受け取ります。結果として得られるベンダー結果の考慮事項は、四捨五入後の USD 0.43 million になります。顧客保持特典は USD 1.95 million です。固定実装料金とサブスクリプション料金は別個に扱われ、投資委員会が総合的な経済性を評価する際に含められるべきです。
イラストは計算設計として読み取ってください。ライブ契約では、さまざまな段階、固定料金、上限、通貨、測定期間を使用できます。そのインプットは、検証された運用データと財務データによって裏付けられる必要があります。価値表では、数値が税引き前か税引後か、現金、会計上の利益、または回避された支出のいずれが測定されているかを特定する必要があります。
12. 実行感度とブレークポイント分析
経済委員会は、商業的な結論を覆す可能性のある変数をテストする必要がある。これらには通常、ベースラインの傾向、比較グループの妥当性、導入、品質上の欠陥、ベンダーの帰属、増分運用コスト、利益の持続性、および手数料上限が含まれます。単一の中心的な推定では、それらの仮定によってもたらされる紛争のリスクが隠蔽されます。
仮説モデルでは、証拠の信頼度が低いほど、裏付けのない帰属推定が増加します。したがって、弱い比較方法では、観察された改善が変わらない場合でも、検証された利点が減少する可能性があります。高品質の障害も適格な価値を低下させます。不十分な証拠と低品質が同じ出来事に影響を与える可能性があるため、相互作用は重要です。契約では控除の順序を定義し、重複した調整を避ける必要があります。
支払いの上限は、顧客が保有する利益と照らし合わせてテストする必要があります。顧客が実装コストと運用コストを回収していないときにベンダーが上限を全額獲得できる場合、その構造は経済的価値のない技術成果に報いる可能性があります。契約では、顧客第一のしきい値、最小利益保持率、または累積調整を通じてこれに対処できます。

オリジナルのイラスト感性。すべての値は USD millionsで、記載されている仮想のウォーターフォールを使用します。
13. 責任と救済策の割り当て
責任は、管理、情報、危害を防止する能力に従うべきです。ベンダーは、モデル開発、サービスのセキュリティ、開示された制限を管理する場合があります。顧客は、目的、展開コンテキスト、ユーザー アクセス、および最終決定を制御できます。サードパーティのモデルまたはデータ プロバイダーが重要な上流コンポーネントを制御する場合があります。責任マトリックスには、保証、補償、除外、上限、保険要件が記載されている必要があります。
EU 人工知能法は、その範囲内のプロバイダー、導入者、その他の関係者に対するリスクベースの義務を定めています。その要件には、ガバナンス、技術文書、ロギング、透明性、人間による監視、正確性、堅牢性、関連システムのサイバーセキュリティが含まれます。 [4] 該当する役割と義務には、システム固有の法的分析が必要です。契約ラベルは法的責任を取り除くことはできません。
救済策は失敗の性質に対処する必要があります。間違った請求書には修正と利息のルールが必要です。サービス障害には信用と修復が必要な場合があります。データの悪用には、削除、通知、補償が必要となる場合があります。モデル パフォーマンスの失敗が繰り返されると、再トレーニング、ロールバック、または終了が必要になる場合があります。有害な決定を行った場合は、顧客による是正や規制当局の対応が必要になる場合があります。契約では、緊急の保護措置を維持し、後で費用を割り当てる必要があります。
成果報酬はコンダクトリスクを生み出す可能性があります。コスト削減にお金を払ったベンダーには、推奨するレビューの数を減らすインセンティブがある可能性があります。顧客の費用を支払ったチームは、料金プールを削減するインシデントを抑制する場合があります。ガバナンス設計では、独立したリスク、コンプライアンス、安全性、監査機能を商業的圧力から保護する必要があります。
14. モデルチェンジとドリフトの制御
AI システムは、新しいモデル バージョン、プロンプト、検索コーパス、ポリシー、統合、データ配布、およびユーザーの行動を通じて変化します。制御不能なシステム変更を許可しながら成功報酬を固定する契約は、測定対象を不安定にします。変更スケジュールでは、変更を重要性ごとに分類する必要があります。
小規模な変更はログに記録され、定期的なテスト後に組み込まれる場合があります。重要な変更には、影響評価、回帰テスト、ベースラインのレビュー、および承認されたリリースが必要です。ワークフローまたは対象となる母集団を変更する変更では、新しい測定期間が必要になる場合があります。緊急のセキュリティ変更は、その後の見直しを経て、迅速なルートで進められる場合があります。
OECD AI 原則では、データセット、プロセス、意思決定にわたるトレーサビリティと、AI ライフサイクル全体にわたる継続的なリスク管理が求められています。 [6] 契約では、バージョン記録、監視、インシデントのしきい値、およびシステムをオーバーライド、修復、または廃止する権利を通じて、これを運用できます。
ドリフト監視では、テクニカル指標を経済的および顧客の成果に結び付ける必要があります。精度が低下すると、ヘッドラインコストに反映される前に手戻りが増える可能性があります。顧客構成が変化すると、モデルのパフォーマンスが低下し、ベースラインが無効になる可能性があります。ガバナンス機関は、警告レベル、停止レベル、所有者、および再起動の証拠を定義する必要があります。
15. 保証と監査の確立
保証は、計算、データ、システム、および制御をテストする必要があります。金融は価値の架け橋を調整することができます。内部監査または合意された独立したレビュー担当者がリネージュとコントロールの運用をテストできます。技術専門家はモデルのパフォーマンスとセキュリティを評価できます。プライバシー、法律、雇用、および各分野の専門家は、自分の能力の範囲内で義務を評価できます。
監査の権利は比例しており、知的財産、機密保持、セキュリティおよび個人データを保護する必要があります。顧客は、モデルの重みや無関係なベンダー情報を受け取ることなく料金を検証するための十分な証拠を必要とする場合があります。考えられるメカニズムには、合意された報告書、安全な検査、第三者による保証、サンプリング、クリーンルームレビュー、専門家の判断が含まれます。
CISA と英国国家サイバー セキュリティ センターの共同 secure-AI ガイダンスは、安全な設計、開発、導入、運用に対処し、顧客のセキュリティ結果の所有権を強調しています。 [9] 価値契約では、セキュリティを継続的なサービス義務として、また違反が測定期間に影響を与える適格な価値の条件として扱う必要があります。
証拠パックは操作中に生成する必要があります。遡及的再構築には費用がかかり、紛争を招きます。月次パックには、バージョン ログ、人口調整、ベースライン入力、イベント ファイル、ガードレール結果、依存関係のパフォーマンス、調整、インシデント、承認、および暫定料金計算を含めることができます。
| 証拠品 | 所有者 | 制御試験 | リテンショントリガー |
|---|---|---|---|
| 対象となるイベント人口 | 運営 | ソースと計算を調整する | 最終決算と監査期間 |
| ベースラインと調整 | ファイナンス | 式と承認を再実行する | 契約と会計方針 |
| モデルとシステムのバージョン | テクノロジー | 実稼働ログを承認されたリリースと照合する | システムおよびインシデントの要件 |
| ガードレールの成果 | リスクとサービスの所有者 | 失敗と逆転のサンプル | 苦情および規制要件 |
| 顧客の依存関係 | プログラム所有者 | 日付のパフォーマンスまたは例外を確認する | 測定および紛争期間 |
| 暫定料金明細書 | ファイナンス | 独立したレビューと承認 | 請求書と法定記録のルール |
オリジナルフレームワーク。証拠へのアクセスと保持には、プライバシー、セキュリティ、法的審査が必要です。
16. 紛争のはしごを作成する
紛争メカニズムは証拠から始まり、問題の種類ごとに段階的に拡大される必要があります。運用データの差異は、指定されたアナリストによって調整できます。会計分類は財務専門家に問い合わせることができます。モデルのパフォーマンスに関する質問には、技術専門家が必要な場合があります。契約の解釈は合意された法的手続きに属します。単一の総合委員会では、4 つすべての能力や独立性が欠けている可能性があります。
スケジュールには、通知期間、議論の余地のない支払い義務、証拠へのアクセス、専門家の任命、審査基準、費用の配分および最終性を記載する必要があります。専門家の質問は範囲が狭いはずだ。たとえば、何が商業的に公平であるかを判断するのではなく、合意されたベースライン計算式が計算に適用されるかどうかを判断します。
重要性のしきい値を使用すると、重要でない差異が正式にエスカレーションされるのを防ぐことができます。小さな差異が繰り返される場合でも、制御上の問題を示している可能性があるため、集計する必要があります。緊急の安全性、プライバシー、またはセキュリティの問題については、商用のはしごを回避し、インシデント手順に従う必要があります。
当事者は完全な決定記録を保存する必要があります。和解により、将来の計算が修正され、以前の金額が取り消され、または 1 回限りの例外が終了する場合があります。その後の測定期間で同じ問題が再発しないように、影響を明示的に記載する必要があります。
17. 経済、会計、開示を分離する
検証された運用利益、契約上の対価、会計上の認識、および現金の支払いは異なる概念です。契約では、会計結果を主張することなく、商業上の計算を定義する必要があります。財務部門は、適用される基準、事業体の事実、および契約条件を評価する必要があります。
IFRS第15号は、変動対価と、対価が逆転する可能性がある場合に適用される制約を扱います。 [10] IAS 第 38 号では、研究支出と、指定された認識基準を満たす開発支出を区別します。 [11] これらの要件は、AI 関連の収益とコストのタイミングと表示に影響を与える可能性がありますが、運営イニシアチブが価値を生み出したかどうかを決定するものではありません。
ビジネスケースでは、総利益、増分運営コスト、固定ベンダー料金、変動ベンダー料金、導入投資、運転資本、税金、現金のタイミングを示す必要があります。これにより、大きな運用上の利益が弱いキャッシュリターンを覆い隠すことを防ぎます。また、投資の承認と実現された成果との間の調整もサポートします。
外部開示では、主張に適切な証拠を使用する必要があります。企業は、AI イニシアチブ、運用指標、または財務効果を開示する場合があります。各ステートメントには、定義された根拠、期間、および制御が必要です。契約の機密保持と顧客データの制限も適用されます。ガバナンス機関は、マーケティング、資金調達、または投資家とのコミュニケーションにおいて成果データを誰が使用できるかを承認する必要があります。
18. 30、90、180 日ゲートを介して実行する
最初の 30 日間で商業的な仮説が定まるはずです。当事者は、ユースケース、価値イベント、ガードレール、ベースラインオプション、データ母集団、責任、固定料金と変動料金の境界、法的境界線を特定します。帰属を十分に客観的にできない場合、委員会は成果報酬案を中止するか再設計すべきである。
90 日目までに、当事者は署名された測定設計、テストされたデータ系統、承認されたシステム バージョン、承認結果、運用責任、インシデント ルート、および暫定レポート パックを取得する必要があります。限られたパイロットでは、イベントと反転が観察可能かどうかをテストできます。パイロットの成功は、結果が判明する前に定義する必要があります。
180 日目までに、組織は少なくとも 1 つの管理された測定サイクルを完了し、ベースラインを調整し、ガードレールをテストし、暫定値ステートメントを発行し、例外を解決する必要があります。その後、委員会は規模を承認したり、契約を修正したり、成果メカニズムを中止したりすることができます。決定では、顧客が保持する利益、管理パフォーマンス、および証拠の品質を総合的に考慮する必要があります。
最終的な動作状態は、再現可能な値制御システムです。各料金明細は、承認された定義、バージョン管理されたデータ、観察可能なイベント、合意された調整、承認された承認まで追跡できます。各材料変更は変更管理を通じて行われます。各インシデントには所有者と救済策があります。それぞれの外部価値の主張には証拠があります。
この構造により、資金が割り当てられる前に貢献、依存関係、不確実性が可視化されるため、連携を改善できます。因果関係の不確実性を取り除くことも、専門家の判断に代わることもできません。その目的は、取締役会、ベンダー、従業員、顧客、監査人、アドバイザーが調査できる、管理された商業プロセス内に不確実性を置くことです。
19. 契約をユースケースに適応させる
共通のアーキテクチャは、各ユースケースの経済性とリスクに適応させる必要があります。顧客サービス システムでは、多数のイベント、短いフィードバック サイクル、および観察可能な逆転が発生する場合があります。研究助手は、より長い連鎖を通じて意思決定に影響を与える可能性があり、定性的なレビューが必要になる場合があります。予知保全システムは、反事実を直接観察できない回避コスト請求を生成する場合があります。価格設定システムは、収益、顧客の公平性、規制上の義務に同時に影響を与える可能性があります。
顧客サービスの場合、価値イベントは、定義された期間を通じて閉じられたままになる、受け入れられた解決策である可能性があります。ベースラインでは、一致するケース タイプ、チャネル、顧客セグメントを比較できます。ガードレールには、苦情、エスカレーション、脆弱な顧客の結果、エージェントのオーバーライドが含まれる場合があります。計算では、逸脱と放棄を区別し、人によるレビュー、品質保証、修復のコストを認識する必要があります。
ソフトウェア開発の場合、コード行や生成された提案は弱い価値の尺度です。より良いイベントには、受け入れられた変更、回避された欠陥、リードタイム、サービスインシデント、およびやり直しが含まれます。ベースラインはプロジェクトの難易度とチーム構成を管理する必要があります。セキュリティ、ライセンス、来歴、レビューのコンプライアンスは不可欠なガードレールです。生産性の主張では、節約された時間がコストの削減、より迅速なリリース、追加の範囲、または未使用の容量になるかどうかを特定する必要があります。
販売およびマーケティングの場合、AI によって生成されたリードまたはメッセージは現金から離れています。イベントチェーンは、資格、受け入れられた機会、署名された契約、提供されたサービス、および回収された現金を通じて進行する必要があります。アトリビューションは、キャンペーン、販売努力、価格設定、製品および市場の状況を考慮する必要があります。顧客の同意、マーケティング法、差別、ブランド行為により、システムの使用が制限される場合があります。
財務業務の場合、重複支払いの防止、調整された請求書の処理、および回収の優先順位付けにより、観察可能なイベントが発生する可能性があります。管理設計では、職務の分離、承認権限、証拠の保持を保護する必要があります。損失を回避するには、合意された比較方法に基づいて支払いまたはエラーが発生した可能性があるという証拠が必要です。運転資本の改善は経常利益とは切り離すべきである。
産業およびインフラストラクチャ用途の場合、価値は物理的な信頼性、安全性、資産の状態に依存する可能性があります。予測された障害によってメンテナンスが促されれば停止は回避されるかもしれませんが、反事実は不確かです。当事者は、工学的証拠、過去の故障率、および限定された専門家の判断を利用できます。安全性と規制管理は商業上の優先事項の範囲外に留まるべきです。
ユースケースのスケジュールには、選択した測定方法が適切である理由を記録する必要があります。これにより、イベント、因果関係、または安全措置が大きく異なる状況に標準のゲインシェア公式をコピーすることが回避されます。したがって、同じベンダーが、共通のデータ、保証、および紛争原則を使用しながら、機能間で異なる測定スケジュールに基づいて運用する可能性があります。
20. 調達、財務、運営の統合
実効価格契約は、提案依頼書が発行される前に開始されます。調達では、入札者に価値事象、依存関係、証拠、制限、データ使用、パフォーマンス テスト、変更プロセス、商業モデルについて説明するよう求める必要があります。同等の価格設定には、共通のシナリオとワークロードが必要です。統合、人間によるレビュー、インフラストラクチャ、保証、および終了コストが他の場所にかかる場合、低い単価は誤解を招く可能性があります。
財務部門は給付金の定義と調整を担当する必要があります。運用はプロセス イベントと採用の証拠を所有する必要があります。テクノロジーはシステム構成、統合、パフォーマンスを所有する必要があります。リスクおよび法務部門は、安全措置と義務を承認する必要があります。調達では、競争上の緊張と契約の一貫性を維持する必要があります。エグゼクティブスポンサーはトレードオフを決定し、ビジネス結果に対して責任を負い続ける必要があります。
ビジネスケースでは、監査可能なコスト分類法を使用する必要があります。初期費用には、検出、データ準備、統合、セキュリティ、テスト、プロセス設計、トレーニング、変更が含まれる場合があります。継続的な支出には、ライセンス、モデルの使用、ホスティング、モニタリング、人間によるレビュー、保証、サポート、修復が含まれる場合があります。終了時の支出には、データの返却、移行、交換、並行操作、契約の決済が含まれる場合があります。
商用比較では、固定サブスクリプション、固定プラスマイルストーン、固定プラス結果の考慮という少なくとも 3 つの構造をテストする必要があります。分析では、予想される顧客コストとマイナス側の顧客コスト、ベンダーのインセンティブ、測定の負担、終了の柔軟性、保持される価値を示す必要があります。選択される構造は、ヘッドライン料金の見かけの調整だけでなく、測定コントロールを運用する組織の能力を反映する必要があります。
調達では、下請け業者と上流の依存関係を確認する必要があります。サービスは、基盤モデルのプロバイダー、クラウド プラットフォーム、専門家のデータ セット、人間によるレビューのサプライヤーに依存する場合があります。これらの依存関係の変更は、価格、権利、セキュリティ、パフォーマンスに影響を与える可能性があります。契約には、関連する通知、フローダウン義務、および材料代替の承認されたルートが必要です。
更新は蓄積された証拠に依存する必要があります。ベンダーは、異常な状況や繰延コストによって初年度の目標を達成できる可能性があります。更新レビューでは、メリットの持続性、顧客保持価値、制御パフォーマンス、インシデント、モデル変更、未解決の依存関係、総コストを調査する必要があります。拡張オプションは、廃止されたベースラインを自動的に引き継いではいけません。
21. 取締役会レベルの価値台帳を使用する
取締役会または投資委員会は、承認された AI 投資と測定された成果および残留リスクを結び付けるコンパクトな記録を必要とします。価値台帳には、ユースケース、所有者、承認されたコスト、ターゲットイベント、ベースライン方法、測定期間、検証済みの利益、キャッシュ効果、ベンダーの考慮事項、顧客の保有価値、ガードレールのステータス、重要なインシデント、および次の決定をリストできます。
元帳では、すべての集計番号の背後にある計算を保存する必要があります。経営者の見積もりは見積もりとして識別され、検証された結果とは区別される必要があります。予測利益を実現利益と組み合わせてはなりません。そのような関連性が主張される場合には、業務改善を財務諸表または現金記録と照合する必要があります。
ポートフォリオレポートは集中力を暴露する可能性があります。いくつかのユースケースは、同じモデルプロバイダー、データプラットフォーム、統合チーム、または顧客プロセスに依存する場合があります。それらの利点は重複する場合があります。サポート人員の共有削減を複数のシステムに完全に割り当てることはできません。ポートフォリオ台帳では、共通のコストと利点を調整し、共通の障害点を特定する必要があります。
台帳は資本配分もサポートします。強力な証拠とプラスの保有価値を備えた取り組みは、規模の対象となる可能性があります。技術的なパフォーマンスはあるものの導入が進んでいない取り組みでは、プロセスの再設計が必要になる場合があります。帰属が不明確な取り組みは固定価格に移行する可能性があります。ガードレールの破損が繰り返される取り組みでは、一時停止または閉鎖が必要となる場合があります。
取締役会の報告には否定的な結果も含める必要があります。失敗した仮説、中止されたパイロット、逆転した利益の透明な記録により、将来の選択とベースライン設計が改善されます。また、公共の成功物語を守るために不経済なシステムを運用し続けるインセンティブも低下します。機密性と特権は、組織のガバナンスと法的アドバイスに従って維持される必要があります。
価値台帳は、法定口座、運用ダッシュボード、またはリスク登録に代わるものではありません。それは、組織が資本と経営陣の注意を契約済みの AI システムに割り当て続ける必要があるかどうかという、特定の決定のために彼らを結びつけます。その強さは、承認された目的、測定された事象、証拠、経済性、安全措置、行動の間の安定した連鎖によってもたらされます。
経営者は、一定の頻度で元帳を照合する必要があります。運営オーナーはイベントの発生数と例外を確認します。財務部門は、計算、コスト、および現金の扱いを検証します。テクノロジーにより、生産構成とパフォーマンス記録が確認されます。リスク部門は、ガードレール違反とオープンな修復を報告します。調達では料金と契約上のマイルストーンを確認します。責任ある幹部は結果として得られた決定に署名し、反対意見があれば記録します。
台帳には、残っている不確実性も示す必要があります。短い観察期間または狭い顧客集団に依存しながらも、契約上の計算に基づいて利益を検証できます。したがって、委員会は測定の完了と証拠の成熟度を区別することができます。永続性が実証されるまで、ホールドバックを保持したり、監視を拡張したり、スケールを制限したりできます。
終了時には、最終的な台帳が終了パックの一部になります。これには、暫定料金と最終料金、未解決の請求、データの返却または削除、システム アクセス、移行サポート、および継続的な義務が調整されます。これにより、両当事者に経済的結果に関する共通の記録が提供され、個別の商業的、技術的、法的な物語への依存が軽減されます。
情報源
- 米国国立標準技術研究所。人工知能リスク管理フレームワーク 1.0. 26 2023 年 1 月。2026 年 9 月 14 日にアクセス。 一次ソースを読む
- 米国国立標準技術研究所。人工知能リスク管理フレームワーク: 生成人工知能プロファイル、NIST AI 600-1。 2024 年 7 月。2026 年 9 月 14 日にアクセス。 一次ソースを読む
- 英国情報コミッショナー局。契約と第三者: 人工知能監査フレームワーク。 2026 年 9 月 14 日にアクセス。 一次ソースを読む
- 欧州連合。規則 (EU) 2024/1689 は、人工知能に関する調和のとれた規則を定めています。 2024 年 6 月 13 日。現在の統合バージョンは 2026 年 9 月 14 日にアクセスされました。 一次ソースを読む
- 世界銀行と米州開発銀行。実践における影響評価、第 2 版。 2016。2026 年 9 月 14 日にアクセス。 一次ソースを読む
- OECD。 OECD AI 原則。 2024 年更新。2026 年 9 月 14 日にアクセス。 一次ソースを読む
- 米国証券取引委員会。 SEC、人工知能の使用に関して虚偽で誤解を招く発言をしたとして投資顧問2名を告発。 2024 年 3 月 18 日。2026 年 9 月 14 日にアクセス。 一次ソースを読む
- 米国政府会計責任局。人工知能: 連邦政府機関およびその他の組織のための説明責任フレームワーク、GAO-21-519SP。 2021 年 6 月 30 日。2026 年 9 月 14 日にアクセス。 一次ソースを読む
- 米国サイバーセキュリティ・インフラストラクチャセキュリティ庁および英国国家サイバーセキュリティセンター。安全な AI システム開発のガイドライン。 2023 年 11 月 26 日。2026 年 9 月 14 日にアクセス。 一次ソースを読む
- IFRS財団。 IFRS第15号 顧客との契約から得られる収益。発行された規格とサポート資料。 2026 年 9 月 14 日にアクセス。 一次ソースを読む
- IFRS財団。 IAS 第 38 号無形資産。発行された規格。 2026 年 9 月 14 日にアクセス。 一次ソースを読む
- OECD。人工知能による統治: 中核的な政府機能における現状と今後の方向性。 2025 年 9 月 18 日。2026 年 9 月 14 日にアクセス。 一次ソースを読む

