経済の基礎
約束を守る人かもしれないという評判で、相手の行動は変わる?
相手が将来も同じ行動を続けるタイプかどうか分からないと、過去の行動はタイプへの信念を変えます。その評判が後の相手の選択へ影響する仕組みを、約束の信頼性や完全情報の反復ゲームと分けて考えます。
基本の用語
一回限りの最適反応と、将来の相手が過去を見て応答する状況は違います。ここでは長く参加する一人と短く参加する相手を置き、固定行動を続けるタイプの可能性を相手が知る模型を扱います。
もう少し詳しく知りたいときは、次の基礎で補えます。
- 一度きりなら損な協力も、付き合いが続けば維持できる?協力を破った今日の得より、今後失う関係の利益が大きいなら、協力を保つ誘因があります。
- 書面で強制できない約束も、取引を続けるために守られる?当事者には分かっても第三者に証明しにくい成果には、強制できる報酬条件を付けにくいことがあります。
短期の相手も評判を見る
完全情報の反復ゲームでは、相手の目的を知った上で、将来の応答が現在の行動をどう変えるかを考えます。評判の模型は、相手がどのタイプなのかについて、分からない部分を加えます。
コミットメント・タイプは、あらかじめ指定された行動を繰り返すタイプです。利得を見て毎回最適化する通常のタイプとは区別します。この仮定を、誰もが実際に同じ行動を永久に続けるという事実と混同しません。
固定行動のタイプである確率が小さくても、将来の相手の応答へ関わる可能性があります。通常タイプの行動も、目の前の得だけでなく、どのタイプだと見られるかを通じた将来の得に影響しえます。
同じ行動を選ぶ型かもしれない
短く参加する相手は、観察した履歴を使って、長く参加する人のタイプを推測します。事前の確率、各タイプがその行動を取る確率、観察した行動を合わせて、ベイズ更新を行います。
両タイプが同じ行動を取ることもあるなら、一回の観察でタイプは確定しません。固定タイプが必ず履行し、通常タイプも一定の確率で履行する例では、履行を見れば固定タイプの割合が上がっても1にはなりません。
何を相手が観察できるかも大切です。行動履歴が見えない、観察に誤りがある、参加者が別人になるといった条件を変えれば、同じ更新を使えません。評判は名前だけに付く数値ではなく、情報とタイプの模型です。
観察で予想を更新する
更新後に、次の相手が取引の期待利益を計算します。本人のタイプは変わらなくても、相手が使う確率が変わるため、その人への応答が変わることがあります。これが履歴から選択へつながる経路です。
下の数例は、通常タイプの履行確率を外から指定し、信念更新だけを示します。通常タイプが将来の評判を考えて何を選ぶかを解いた均衡ではありません。更新の計算と、戦略を内生的に求める問題を分けます。
評判があれば常によい結果になるとは限りません。どの固定行動が想定され、相手が何を利益と評価するかによって結果が変わります。過去の行動だけで次の履行を保証したり、実際の取引相手の信用を断定したりする結論には広げません。
- 事前の信念
固定20%・通常80%。履行見込み60%。
- 履行を観察
固定タイプの事後確率1/3。
- 次の取引の比較
履行見込み2/3、期待利益1/3。
タイプ別行動確率を固定した架空のベイズ更新です。通常タイプの戦略的な選択を解いた均衡でも、実在相手の履行予測でもありません。
架空の例:一回の履行で信念が変わる
固定タイプを20%、通常タイプを80%とし、固定タイプは必ず履行、通常タイプは確率1/2で履行すると置きます。履行を観察する確率は0.2+0.8×0.5=0.6。履行を見た後の固定タイプ確率は0.2/0.6=1/3です。
次回も同じタイプ別確率なら、履行見込みは1/3+(2/3)×1/2=2/3です。取引相手の得を履行時2、不履行時−3とすると、観察前の期待利益は0、観察後は1/3へ上がります。固定タイプと判明したのではなく、混ざり方への信念が変わった計算です。
持ち帰る見方
- 観察した行動と、タイプ別の行動確率を分ける。
- 信念更新の数例と、評判形成の均衡を区別する。
次に広がる疑問
- 私的な事情は均衡にどう入る?
- 完全情報で協力が続く条件は?
順番に読んでいる方へ
出典
Reputation — MIT 14.126 (2016)(MIT OpenCourseWare / Mihai Manea)https://ocw.mit.edu/courses/14-126-game-theory-spring-2016/8a76b8f16b6c2c1dac0281cc7e194629_MIT14_126S16_reputation.pdf
確認日:2026-10-07
本文の出典・補足
短期の相手も評判を見る
評判模型では、長期プレイヤーに対し一期間の相手が、長期側の予想行動への最適反応を選ぶ。
- 対象
- 長期プレイヤーが固定行動型かもしれないという短期相手の信念と観察更新を扱う。
- 条件
- 長期側のタイプは本人だけが知る、固定行動型へ正の事前確率、相手は一期間のみ、過去の行動観察、ベイズ更新。架空例の通常型の行動確率は仮定。
- 例外・限界
- 一度の観察でタイプ確定とは限らない。信用が高ければ現実の品質保証という意味ではない。双方が長期の反復協力と区別。
Reputation — MIT 14.126 (2016)(MIT OpenCourseWare / Mihai Manea)https://ocw.mit.edu/courses/14-126-game-theory-spring-2016/8a76b8f16b6c2c1dac0281cc7e194629_MIT14_126S16_reputation.pdf
同じ行動を選ぶ型かもしれない
長期側は通常の利得を持つタイプか、同じ行動を全履歴で選ぶ固定行動型かもしれず、本人だけがタイプを知る。
- 対象
- 長期プレイヤーが固定行動型かもしれないという短期相手の信念と観察更新を扱う。
- 条件
- 長期側のタイプは本人だけが知る、固定行動型へ正の事前確率、相手は一期間のみ、過去の行動観察、ベイズ更新。架空例の通常型の行動確率は仮定。
- 例外・限界
- 一度の観察でタイプ確定とは限らない。信用が高ければ現実の品質保証という意味ではない。双方が長期の反復協力と区別。
Reputation — MIT 14.126 (2016)(MIT OpenCourseWare / Mihai Manea)https://ocw.mit.edu/courses/14-126-game-theory-spring-2016/8a76b8f16b6c2c1dac0281cc7e194629_MIT14_126S16_reputation.pdf
観察で予想を更新する
観察された行動履歴は、固定行動型に関する相手の条件付き確率を変える。
- 対象
- 長期プレイヤーが固定行動型かもしれないという短期相手の信念と観察更新を扱う。
- 条件
- 長期側のタイプは本人だけが知る、固定行動型へ正の事前確率、相手は一期間のみ、過去の行動観察、ベイズ更新。架空例の通常型の行動確率は仮定。
- 例外・限界
- 一度の観察でタイプ確定とは限らない。信用が高ければ現実の品質保証という意味ではない。双方が長期の反復協力と区別。
Reputation — MIT 14.126 (2016)(MIT OpenCourseWare / Mihai Manea)https://ocw.mit.edu/courses/14-126-game-theory-spring-2016/8a76b8f16b6c2c1dac0281cc7e194629_MIT14_126S16_reputation.pdf