Utiliser le renforcement à ratio variable pour rendre les habitudes persistantes
Une fois qu'un comportement est établi, passez à un calendrier de récompense imprévisible pour le rendre résistant à l'extinction.
Why it works
Les calendriers à ratio variable (RV) récompensent le comportement après un nombre imprévisible de réponses — la caractéristique définissant le jeu d'argent. Le RV produit le taux de réponse le plus élevé et l'extinction la plus lente de tout calendrier de renforcement parce que chaque réponse non récompensée pourrait être la dernière avant la récompense. L'animal ou l'humain ne sait pas quand s'arrêter parce que la prochaine réponse pourrait être la gagnante. Cela rend les habitudes RV très durables — mais signifie aussi qu'elles peuvent être exploitées par les concepteurs d'applications et les casinos.
How to do it
- Établissez le comportement sur un calendrier continu ou fixe d'abord — récompensez chaque occurrence jusqu'à ce qu'il soit fiable.
- Une fois le comportement constant, introduisez des récompenses surprises occasionnelles : une gâterie spontanée, une vérification inattendue, une célébration aléatoire.
- Gardez les récompenses véritablement imprévisibles, pas seulement peu fréquentes — une récompense hebdomadaire programmée est un intervalle fixe, pas variable.
- Utilisez le renforcement variable seulement pour les comportements que vous voulez maintenir, pas pour ceux que vous voulez éteindre.
Données probantes
Les effets du calendrier à ratio variable sur le taux de réponse et la résistance à l'extinction sont parmi les découvertes les plus répliquées de Skinner, démontrées à travers les espèces et types de comportement. (rct)
La plupart des données fondatrices proviennent de recherche animale (pigeons, rats). La traduction vers le comportement humain complexe en contexte naturel exige des précautions ; le contexte social et cognitif module l'effet du calendrier.
Sources
- Ferster & Skinner (1957), "Schedules of Reinforcement" — foundational experimental data
- Ferster, C. B., & Skinner, B. F. (1957). Schedules of Reinforcement. New York: Appleton-Century-Crofts.
Erreur fréquente
Appliquer le renforcement variable avant que le comportement soit établi — la variabilité pendant l'acquisition ralentit l'apprentissage ; c'est un outil de maintien, pas d'acquisition.
Pratiquez cela avec IX Coach
More practices for Le conditionnement opérant et les calendriers de renforcement
- Concevoir un véritable renforçateur positif pour le comportement cible
Identifiez quelque chose qui augmente véritablement votre probabilité de répéter le comportement — pas ce qui devrait fonctionner, mais ce qui fonctionne réellement.
- Façonner des comportements complexes par approximations successives
Renforcez des approximations progressivement plus proches du comportement cible plutôt que d'attendre que le comportement complet apparaisse.
- Éteindre les comportements indésirables en retirant leur renforcement
Arrêtez un comportement en retirant constamment le renforçateur qui le maintient — pas en le punissant.
- Utiliser le renforcement différentiel pour augmenter le comportement désiré tout en réduisant le comportement indésirable
Renforcez le comportement que vous voulez tout en retirant le renforcement de celui que vous ne voulez pas — en même temps.
- Rendre les conséquences immédiates pour combler le problème du délai de récompense
Plus une conséquence suit rapidement dans le temps un comportement, plus son effet sur ce comportement est fort.
- Modifier les antécédents pour déclencher le comportement avant qu'il ne dépende de la motivation
Changez les signaux qui précèdent un comportement pour le rendre plus ou moins probable.
Concepts associés
- Atomic Habits, rendu pratique
The four laws, the real mechanisms, and where the science is strong
- Conditionnement classique et déclencheurs d'habitudes
How neutral cues become powerful habit triggers — and how to use that fact
- La puissance des habitudes, rendue pratique
The habit loop, craving, keystone habits, and an honest read on the science