戦略的相互作用と協力
このページの目次
2つのチームが同じインターフェースを共有している。双方が文書を慎重に維持し、長期的な協力関係が最も円滑に進む場合もあれば、相手がすでに文書を作成済みであれば、自らは維持時間を節約して相手の成果を直接使用する方が、目先の利益が高くなる場合もある。ここで問われているのは、「私の行動が単独でもたらすものは何か」ではなく、「相手も選択を行っている状況下で、私の最適な行動は何か」である。
本稿では、まず1回の相互作用において選択を行い、次にインセンティブを列ごとに検証し、最後に将来の協力機会と観測可能性を変更する。以下の利得は架空の純利得ポイントであり、今回の投入コストと使用価値を総合したものである。数値は比較のためにのみ機能し、チームの実際の業績を表すものではない。
まず選択し、双方のインセンティブを見る
各チームは、文書維持(C)または省力化(D)のいずれかを選択できる。行列の第1項は甲の利得、第2項は乙の利得を示す。両者は同時に選択を行い、事前に強制執行可能な文書維持契約を締結することはできない。
| 甲の選択 / 乙の選択 | 乙が維持 C | 乙が省力化 D |
|---|---|---|
| 甲が維持 C | 3,3 | 0,5 |
| 甲が省力化 D | 5,0 | 1,1 |
ここで一旦停止:もしあなたが甲であれば、どのように選択するか?その理由については、乙の特定の選択に対して明確に言及しなければならず、「協力するのが皆にとって最善だから」というだけでは不十分である。
乙が維持を選択していると固定して考えると、甲は同じ列で比較を行う:維持すれば3、省力化すれば5を得るため、省力化の方が良い。乙が省力化を選択していると固定して考えると、甲は別の列で比較を行う:維持すれば0、省力化すれば1を得るため、やはり省力化の方が良い。この表において、Dは甲にとって厳密な支配戦略であり、乙が何を選択してもCよりも優れている。乙も対称的な構造に直面しており、同様に比較を行う。
その結果、双方が省力化を選択し、利得は1、1となる。この状況において、甲が単独で維持に変更すると利得は1から0に低下し、乙も同様である。誰もが一方的に行動を変更することで自らの利得を高めることができないため、これはナッシュ均衡である。
ナッシュ均衡は、利得が最大であること、道徳的に最善であることを意味するものでも、現実において直ちに到達するものであることも意味しない。それは、他のプレイヤーの行動が与えられたときに、自分が行動を変更したいと思うかどうかのみを検査するものである。双方が一緒に維持に変更すれば3、3を得られるが、「一緒に良くなる」ことが「個人が独自に変更する際に有利になる」ことを意味するわけではない。
なぜ口約束だけでは不十分なのか
2つのチームが文書維持に合意しても、行列が自動的に変化することはない。実行段階において、乙が契約通りに維持を行ったとしても、甲は維持から得られる3ではなく、省力化から5を得ることができる。将来の帰結、責任制約、または異なる選好がない限り、事前の約束は事後の逸脱インセンティブを解消できない。
これは、人間が常に利己的であり、協力が不可能であることを意味するものではない。それは、現在のモデルがどのような利得を見落としているか、すなわち評判、職業規範、違約コスト、同僚への配慮などが真の選択に影響を与える可能性があることを示している。協力を説明するためには、古い利得表を使いながら人々が自然と別の結果を選択することを求めるのではなく、関連する要因を明示的に組み込む必要がある。
例えば、独立した検収によって文書維持が行われていないことが発見され、省力化に対して3ポイントの利得を控除するとする。乙が維持している場合、甲が省力化しても利得は2となり、維持の3を下回る。乙が省力化している場合、甲が省力化すると利得は-2となり、維持の0を下回る。新しい表では、維持が支配戦略となる。このルールを採用する価値があるかどうかは、検収コストを差し引いた上で、行動を確実に識別できるかどうかを確認する必要があり、罰則を無コストのスイッチとして扱うことはできない。
同じ人々が将来も協力するか
ここで条件を変更する:2つのチームは毎期協力する必要があり、現在の行動は正確に観察される。条件付き協力戦略を考える:以前に双方が維持を続けていれば、維持を続ける。一度でも誰かが省力化すれば、以後はすべて省力化する。将来の一期の利得が現在に対する重みδ(0≤δ<1)であるとする。
維持を継続する利得は 3+3δ+3δ²+…=3/(1−δ) である。今、密かに省力化すると、一度に5を得て、以後の毎期に1を得るため、利得は 5+δ/(1−δ) となる。維持が少なくとも劣らないためには、以下の条件が必要である:
3/(1−δ) ≥ 5+δ/(1−δ)
3 ≥ 5−4δ
δ ≥ 0.5
例えば δ=0.8 の場合、維持継続の価値は15、逸脱は9である。将来の関係が十分に重要であれば、目先で2多く得ることは価値がない。δ=0.2 の場合、維持継続は3.75、逸脱は5.25であり、罰則が遠すぎるか関係が不安定すぎると、協力を支えるのに不十分となる。
これは、戦略が与えられ、正確な観察が可能で、無限または不確実な終了点を想定した場合の条件付き検証であり、すべてのチーム協力の普遍的な閾値ではない。反復相互作用が必ず協力を生み出すわけではない。双方が同じ戦略に調整できない可能性もある。
誤報と関係の終了を戻す
ドキュメントプラットフォームで送信の消失が稀に発生する場合、1つの技術的障害が省力化として誤認され、永続的な罰則が本来継続できた協力を破壊する可能性がある。今や、逸脱防止に加え、異議申立て、補完提出、証拠照合、または有限の罰則が必要である。寛容さは誤傷を減らす可能性があるが、悪用される可能性もあり、ルールは2つの問題の間でバランスを取る必要がある。
双方が残り期間が最終期であることを共有し、元の純利得構造を維持している場合、最終期には将来の罰則がないため、依然として省力化を選択する。遡行帰納法(バックワードインダクション)は前期の選択に影響を与える。この有限期間の結論は、明確な終了点、共通知識、完全合理性などの条件に依存している。実際の組織には、その後の評判、プロジェクト間の関係、不完全情報などが存在するため、「プロジェクトが終了間近である」という理由だけで、必ず協力しないと断言することはできない。
順序選択を行う場合、別の意思決定木を描く必要がある。甲が先に投資を行い、乙が観察してから決定する場合、甲は乙のその時点での最適反応を予測しなければならない。「彼が報いてくれることを願う」ことを信頼できる約束として扱うことはできない。契約、預かり金、マイルストーン検収の役割は、将来の特定のノードにおける利用可能な選択肢と利得を変更することにある。
均衡と評価を分離する
この表には、2つのチームの純利得のみが含まれている。もし彼らの協力がサードパーティに損害を与え、例えばサービス提供を共同で制限してユーザーにより高い代価を強いる場合、両者の利得が上昇しても、社会全体の福祉が向上したことを意味しない。ゲーム理論分析は参加者の行動を説明するが、評価には除外された主体を組み込む必要がある。
同様に、ある均衡は誤った情報、高い移行コスト、または不公平な初期の権利に基づいている可能性がある。均衡を見つけることは分析の1ステップに過ぎず、ルール自体に関する議論に代わるものではない。次のレッスンでは、情報と契約を用いて、「相手はどのようなタイプか」「相手はその後何を行ったか」が観察できない場合の取引処理を続ける。
ラベルではなく比較で答える
双方が維持した場合の利得を3、3から6、6に変更し、他の3つのセルは不変とする。省力化は依然として甲の支配戦略か?双方の省力化は依然としてナッシュ均衡か?
推論を展開
乙が維持していると固定して考えると、甲は維持すれば6、省力化すれば5を得るため、甲は維持すべきである。乙が省力化していると固定して考えると、甲は依然として省力化するべきである。したがって、省力化はもはや支配戦略ではない。双方の省力化は依然としてナッシュ均衡である。なぜなら、一方的に維持に変更すると利得が1から0に低下するためである。また、双方の維持もナッシュ均衡となる。なぜなら、逸脱すると利得が6から5に低下するためである。この場合、調整問題が発生し、元の唯一の優位結果をそのまま適用することはできない。
マネージャーは「今後、省力化するチームとは取引しない」と言うが、そのチームは障害を修理できる唯一の設備を掌握している。この脅しは本当に信頼できるか?モデルをどのように補完すべきか?
推論を展開
必ずしも信頼できるとは限らない。実際に修理が必要な将来のノードにおいて、マネージャーの選択を比較する必要がある:非協力による損失が継続的な協力よりも大きいか、代替設備が存在するか、約束には実行可能な制約があるか。もしその時、マネージャーが常に継続的な協力を選択するのであれば、相手はそれを予測するだろう。信頼性は、言葉の強さによって支えられるのではなく、将来のノードにおけるインセンティブによって支えられる必要がある。
参考資料
以下は概念・統計定義の参考資料です。数値例と図は独自の教材用設定です。