報酬を確実に予測する手がかりを設計する
報酬を予測する手がかりは、やがて報酬そのものと同じドーパミン反応を引き起こす。
Why it works
シュルツは、手がかりが多くの試行にわたって確実に報酬を予測すると、ドーパミン活動が報酬の瞬間から手がかりへとシフトすることを示した。手がかりそのものがモチベーションを生むようになる——これがジムのプレイリストを聞くと運動への衝動を感じたり、特定のコーヒーマグが執筆セッションを魅力的に感じさせたりする理由だ。手がかりは、行動が始まる前からモチベーションを呼び込む。
How to do it
- 目標とする行動のためだけに使う手がかり(音、匂い、場所、物)を選ぶ。
- 少なくとも数週間、それを本物の報酬と一貫してペアにする。
- その排他性を保つ——手がかりが他の文脈で現れると、予測が薄まってしまう。
エビデンス
手がかりからドーパミンへの転移は、シュルツの記録研究からの基礎的な発見であり、動物学習でよく再現されており、条件づけられた「欲求」に関する人間の画像研究とも整合的だ。 (observational)
手がかりの転移には時間をかけた一貫したペアリングが必要だ——一度や二度のセッションでは起こらない。手がかり反応の強度は、ペアリングの信頼性に比例する。
出典
- Schultz, Dayan & Montague (1997), A neural substrate of prediction and reward, Science
よくある間違い
手がかりをあまりに多くの文脈で使いすぎること——報酬なしでその文脈が現れれば現れるほど、それがコード化する予測は弱まる。
IX Coach でこれを実践する
More practices for 報酬予測誤差:ドーパミン科学でモチベーションを保つ
- ルーティンに制御された新奇性を取り入れる
習慣をやりがいのあるものにしている予測誤差シグナルを保つために、やり方を変える。
- 毎回ではなく間欠的に進捗を報いる
可変報酬は固定報酬よりもモチベーションを維持する。なぜならそれは決して予測誤差を完全には消し去らないからだ。
- 毎日、小さな進捗のシグナルを追跡し祝う
本物の一歩一歩が予測誤差の報酬を生む。遠い目標に到達しても、たった一回のヒットしか生まない。
- 自分の報酬を過剰な露出から守る
報酬がやりがいのあるものに感じられなくなったら、それはモチベーションとしての役割を果たせなくなる——それを控えめに使うことで守る。
- 報酬の前に予期の窓を作る
報酬を計画し楽しみに待つことは、報酬が届く前にドーパミンの原動力を呼び込む。
- 報酬が届かなかったときのドーパミンの落ち込みを積極的に管理する
失望とは逆向きの予測誤差だ——押し通そうとするのではなく、それを認めること。