Recompensa el progreso de forma intermitente en lugar de cada vez

Las recompensas variables mantienen la motivación mejor que las fijas porque nunca extinguen del todo el error de predicción.

Why it works

El reforzamiento de tasa fija (recompensa cada vez) entrena rápido al sistema de dopamina pero produce extinción rápida cuando la recompensa se detiene y una activación modesta porque el error de predicción va a cero. El reforzamiento variable mantiene activa la señal de error de predicción porque la recompensa sigue siendo parcialmente incierta — exactamente el patrón que impulsa la persistencia vista en el juego y las apps de alto compromiso, pero orientado de forma productiva.

How to do it

  1. Celebra algunas terminaciones con una recompensa, pero no cada una — sé genuinamente variable.
  2. Deja que la celebración sea significativamente buena, no simbólica — cuanto más grande sea la recompensa ocasional, más fuerte la señal.
  3. No fijes un calendario fijo; la incertidumbre es el mecanismo.

Evidencia

Los programas de razón variable producen los patrones de respuesta más resistentes a la extinción en la investigación de condicionamiento operante — un hallazgo conductual robusto replicado en distintas especies y contextos. (observational)

El reforzamiento variable también sustenta los patrones de comportamiento adictivo; el mismo mecanismo que impulsa la persistencia puede volverse compulsivo si el comportamiento en sí es dañino.

Fuentes

  • Ferster & Skinner (1957), Schedules of Reinforcement — foundational operant conditioning research

Error común

Celebrar cada terminación individual — el reforzamiento fiable mantiene el hábito bien pero gradualmente pierde el impulso anticipatorio que te emociona para empezar.

Practica esto con IX Coach

Empieza con IX Coach

More practices for Error de Predicción de Recompensa: Usar la Ciencia de la Dopamina para Mantenerte Motivado

Conceptos relacionados