⏱️ 30 秒版(先看這裡!)
一、「一背叛就永遠翻臉」很有效,但太狠——一個無心之過就永遠決裂,太不容錯。 二、改成「只罰一回合」的溫和版,但代價是雙方得更有耐心才行得通。 三、在沒有法律保護的地方,工廠靠「可以開除你」的威脅,加上高薪,來防止工人偷東西。
🔨 「永遠翻臉」太狠了
上一課的「冷酷觸發」——只要背叛一次就永遠不合作——確實能嚇阻背叛。但它有個大問題:完全不容許犯錯。
現實中,人可能不小心出錯(算錯數量、誤會一場),並不是真的想騙人。如果一次無心之過就讓珍貴的長期合作永遠破裂,那也太可惜、太殘忍了(像犯一點小錯就判死刑)。
① 溫和版:只罰一回合,然後原諒
所以我們設計一個溫和一點的策略:如果有人背叛,就只懲罰一回合,之後大家和好、恢復合作。這樣萬一是誤會,也不會兩敗俱傷一輩子。
但這裡有個必須付出的代價。因為明天的懲罰變輕了(只罰一次,不是永遠),所以要嚇阻今天的背叛,雙方就得對未來更有耐心才行。
- 「永遠翻臉」版:只要再見面機率高於 三分之一 就行。
- 「只罰一回合」版:要高於 二分之一 才行。
一句話:懲罰越輕,就越需要大家珍惜未來。 就像教小孩——如果只罰「今天不能吃餅乾」(而不是永遠不准),那要小孩不偷吃,他就得夠在乎明天的餅乾。
② 為什麼工廠付「防偷高薪」?
最後看一個超實際的例子:外包。有間美國公司想到一個工資很低的國家設廠,但那裡法律不健全,簽了合約也告不成。
公司得先把值錢的原料設備運給當地工人。麻煩來了——工人大可把設備偷去賣掉(賺一筆),再去打別的工。怎麼防?
- 只做一次:公司只能付兩倍的高薪(叫工資溢價),讓工人覺得「乖乖工作比偷東西划算」,才留得住人。
- 長期合作:如果雙方會一直合作,公司就多了一個武器——「你敢偷,我就開除你,你以後這份高薪就沒了!」有了這個威脅,公司不必付到兩倍也能防偷。
而且合作越長久(越可能一直做下去),需要的防偷加薪就越少。如果雙方打算永遠合作下去,公司甚至只要付當地的一般薪水就好!在告不了對方的地方,「失去未來的好工作」比法律更能管住人。
🤔 小朋友想想看: 為什麼「常客」通常能得到店家更好的服務和信任?跟「開除」的威脅有什麼關係?
🎒 今天學到了什麼?
- 「永遠翻臉」的冷酷觸發雖有效,但不容錯,一次誤會就永久決裂。
- 「只罰一回合」的溫和策略能容錯,但需要雙方更有耐心(門檻更高)。
- 懲罰強度與耐心可以互換:罰得越輕,就越需要大家在乎未來。
- 外包防偷:長期關係讓「開除」變成有效武器,能大幅降低需要付的防偷工資溢價。
Q: 「只罰一回合」的溫和策略,比「永遠翻臉」多要求什麼? - 更多玩家 - *雙方對未來更有耐心(再見面機率門檻更高,從1/3升到1/2) - 一定要簽合約 解釋: 懲罰越輕,越需要重視未來,才能嚇阻今天的背叛。 Q: 在法律不健全的地方,工廠靠什麼防止工人偷東西? - 靠警察 - *靠「可以開除你、讓你失去未來高薪」的威脅,加上防偷高薪 - 靠運氣 解釋: 無法訴諸法律時,失去未來的高薪工作是最強的行為約束。 Q: 為什麼長期合作能降低「防偷工資溢價」? - 因為工人變乖了 - *合作越可能持續,「開除」威脅越有力,就不必靠超高薪來防偷 - 因為物價下跌 解釋: δ 越高,未來懲罰越有威懾力,均衡工資溢價(如 2−δ)越低。
22. Repeated Games: Cheating, Punishment, and Outsourcing
📖 家長導讀
本講深化懲罰機制設計:先驗證冷酷觸發的可信度,再以「一期懲罰策略」解決其零容錯弊端(臨界 由 1/3 升至 1/2,揭示「懲罰強度 vs. 耐心」的替換),最後建構外包的重複道德風險模型,論證長期關係如何壓低工資溢價。孩子版聚焦「太狠、只罰一回合、開除與防偷高薪」;本版補齊推導。
🔍 完整概念
一、冷酷觸發的可信度與預測。 進入懲罰階段後收益矩陣縮為 (D,D)=0、(C,D)=−1,最佳反應仍為 D,故 (D,D) 為單期納許、懲罰可信、符合 SPE。偏離路徑(首期背叛得 3、次期改 C 得 −1、其後永遠 D)現值 ,證明背叛後立即順應懲罰為最佳。=關係續存機率:預測畢業季遠距戀劈腿率上升( 驟降)、爛車車主與修車廠因 互不信任。
二、一期懲罰策略。 規則:首期 C;上期 (C,C)/(D,D) → 本期 C;上期 (C,D)/(D,C) → 本期 D(罰一期後復合)。守約現值 ;背叛現值 。SPE 條件化簡得 (高於冷酷觸發的 )。核心洞察:懲罰越輕,維持合作所需的 (耐心/續存機率)越高——兩者為替換關係(教養類比:只罰一期須孩子夠重視明天)。
三、外包的重複道德風險。 低工資但無有效司法(合約難執行)。委託人須先運交值 1 的物資。代理人背叛:竊售物資得 1+打零工市價 1=共 2;誠實:領工資 。單期須 (市價 1,故 100% 溢價)。重複(續存機率 ,背叛則次期起被解僱只能領市價 1):誠實現值 、背叛現值 ,SPE 條件得 。邊界:(100% 溢價)、(50%)、(0%)。長期關係顯著壓低防背叛溢價;「解僱」(失去未來高薪)為無法律環境下最強約束,須雙向可信承諾;分散多代理人以緩衝誤判解僱。
✅ 查核筆記(依本模型知識庫)
- 課程來源:屬實,Yale ECON 159 第二十二講,Ben Polak,Open Yale Courses。
- 一期懲罰臨界 :屬實,依本講收益結構推導無誤;懲罰強度與耐心的替換為重複賽局標準性質。
- 效率工資 / 防背叛溢價 :屬實,屬 Shapiro–Stiglitz 效率工資與重複道德風險的教學化案例。
- 開發中國家外包支付高於當地均薪:屬實觀察,可由防弊均衡工資(而非單純慷慨)解釋。
📚 原始出處
- Yale ECON 159 第二十二講(YouTube)|Ben Polak,Open Yale Courses
🧭 接下來讀這篇
- 👉 下一關:沉默,為什麼會「洩露秘密」?
- 📖 工資與工作:提高最低工資,一定會害人失業嗎?
📋 AI 共學與免責聲明
本教材為 SparkSoul 智慧實驗室家庭共學的實驗紀錄,由 AI 協作萃取整理自公開課程或文獻,家長一起參與閱讀。我們不保證學術上的絕對無誤,鼓勵讀者點擊原始連結進行深度探索;若發現錯誤,歡迎透過 Facebook 粉專 告訴我們。涉及醫療、投資或法律等專業判斷,請另行諮詢專業人士。
原始來源
- 📺 點此觀看原始來源