Usa el reforzamiento de razón variable para hacer los hábitos persistentes
Una vez establecida una conducta, cambia a un programa de recompensa impredecible para hacerla resistente a la extinción.
Why it works
Los programas de razón variable (RV) recompensan la conducta después de un número impredecible de respuestas: la característica definitoria del juego de apuestas. La RV produce la mayor tasa de respuesta y la extinción más lenta de cualquier programa de reforzamiento porque cada respuesta no recompensada podría ser la última antes de la recompensa. El animal o humano no sabe cuándo detenerse porque la siguiente respuesta podría ser la ganadora. Esto hace que los hábitos de RV sean muy duraderos, pero también significa que pueden ser explotados por diseñadores de apps y casinos.
How to do it
- Establece la conducta primero con un programa continuo o fijo: recompensa cada ocurrencia hasta que sea confiable.
- Una vez que la conducta sea consistente, introduce recompensas sorpresa ocasionales: un obsequio espontáneo, un check-in inesperado, una celebración aleatoria.
- Mantén las recompensas genuinamente impredecibles, no solo poco frecuentes: una recompensa semanal programada es un intervalo fijo, no variable.
- Usa el reforzamiento variable solo para conductas que quieres mantener, no para las que quieres extinguir.
Evidencia
Los efectos del programa de razón variable sobre la tasa de respuesta y la resistencia a la extinción están entre los hallazgos más replicados de Skinner, demostrados en distintas especies y tipos de conducta. (rct)
La mayoría de los datos fundacionales provienen de investigación animal (palomas, ratas). La traducción a la conducta humana compleja en entornos naturalistas requiere cuidado; el contexto social y cognitivo modula el efecto del programa.
Fuentes
- Ferster & Skinner (1957), "Schedules of Reinforcement" — foundational experimental data
- Ferster, C. B., & Skinner, B. F. (1957). Schedules of Reinforcement. New York: Appleton-Century-Crofts.
Error común
Aplicar el reforzamiento variable antes de que la conducta esté establecida: la variabilidad durante la adquisición ralentiza el aprendizaje; es una herramienta de mantenimiento, no de adquisición.
Practica esto con IX Coach
More practices for Condicionamiento Operante y Programas de Reforzamiento
- Diseña un reforzador positivo genuino para la conducta objetivo
Identifica algo que genuinamente aumente tu probabilidad de repetir la conducta, no lo que debería funcionar, sino lo que realmente funciona.
- Moldea conductas complejas mediante aproximaciones sucesivas
Refuerza aproximaciones progresivamente más cercanas a la conducta objetivo en lugar de esperar a que aparezca la conducta completa.
- Extingue conductas no deseadas eliminando su reforzamiento
Detén una conducta reteniendo consistentemente el reforzador que la mantiene, no castigándola.
- Usa el reforzamiento diferencial para aumentar la conducta deseada mientras reduces la no deseada
Refuerza la conducta que quieres mientras retienes el reforzamiento de la que no quieres, al mismo tiempo.
- Haz las consecuencias inmediatas para superar el problema de la recompensa postergada
Cuanto más cercana en el tiempo sigue una consecuencia a una conducta, más fuerte es su efecto sobre esa conducta.
- Modifica los antecedentes para desencadenar la conducta antes de que dependa de la motivación
Cambia las señales que preceden a una conducta para hacerla más o menos probable.
Conceptos relacionados
- Hábitos Atómicos, en la Práctica
The four laws, the real mechanisms, and where the science is strong
- Condicionamiento Clásico y Disparadores de Hábitos
How neutral cues become powerful habit triggers — and how to use that fact
- El Poder de los Hábitos, Hecho Práctico
The habit loop, craving, keystone habits, and an honest read on the science