alliknow
Accueil · Psychologie · Cours - Paul Bloom (Yale)

Skinner et le behaviorisme (cours Paul Bloom)

Psychologie → Fondations → « Tout est appris » : la grande théorie rivale de Freud — Le behaviorisme est, avec la psychanalyse, la seconde grande « théorie de tout » que Bloom examine dans ses cours…

Psychologie → Fondations → « Tout est appris » : la grande théorie rivale de Freud


L’autre « théorie de tout »

Le behaviorisme est, avec la psychanalyse, la seconde grande « théorie de tout » que Bloom examine dans ses cours de fondations. Les deux prétendent expliquer l’ensemble du comportement humain à partir de quelques principes — mais elles sont diamétralement opposées sur un point : là où Freud fait de l’inconscient le moteur de tout, le behaviorisme refuse purement et simplement de parler de la vie intérieure. Ni pulsions, ni désirs, ni pensées : rien de ce qu’on ne peut pas observer.

Le behaviorisme naît au début du XXe siècle avec John B. Watson (qui publie en 1913 son manifeste Psychology as the Behaviorist Views It), puis domine la psychologie américaine pendant près d’un demi-siècle. Il est surtout popularisé et radicalisé par B. F. Skinner (années 1950-70), sans doute le psychologue américain le plus influent de son temps.

Bloom résume la doctrine en trois thèses radicales :

  1. Tout est appris — il n’y a pas de nature humaine. L’esprit est une table rase, entièrement façonnée par l’environnement. La citation emblématique est celle de Watson : « Donnez-moi une douzaine de nourrissons en bonne santé, et mon propre monde spécifié pour les élever, et je garantis d’en prendre un au hasard et d’en faire n’importe quel type de spécialiste — médecin, avocat, artiste, marchand, et oui, même mendiant ou voleur — sans égard pour ses talents, ses penchants, ses tendances, ses aptitudes ou la race de ses ancêtres. »

  2. L’anti-mentalisme. Les états mentaux invisibles (croyances, désirs, émotions, pensées) ne sont pas des objets scientifiques : on ne peut pas les observer, donc la science ne doit pas en parler. Le vocabulaire légitime se réduit à trois termes observables : stimulus, réponse, renforcement.

  3. Pas de différence fondamentale entre les espèces. Les mêmes lois de l’apprentissage valent pour le rat, le pigeon, le chien et l’homme. C’est ce qui justifie l’étude des animaux (souvent le rat en labyrinthe, le pigeon en boîte) pour comprendre l’être humain.

1. L’habituation

La forme la plus simple d’apprentissage. L’organisme cesse progressivement de répondre à un stimulus familier et répété qui ne s’avère ni dangereux ni utile. On sursaute au premier bruit fort, plus au dixième ; on remarque une odeur en entrant dans une pièce, plus au bout d’une minute. C’est profondément adaptatif : il faut économiser son attention en ignorant le connu pour repérer le nouveau.

Bloom souligne un intérêt méthodologique majeur : l’habituation est un outil pour étudier ceux qui ne parlent pas — les bébés et les animaux. En mesurant le retour de l’attention (la « déshabituation ») quand on change quelque chose, on peut savoir si le sujet perçoit une différence ou trouve une situation surprenante — donc sonder indirectement ce qu’il « sait ».

2. Le conditionnement classique (Pavlov)

Le conditionnement classique consiste à apprendre une association entre deux stimuli. C’est la découverte du physiologiste russe Ivan Pavlov (prix Nobel de médecine, qui étudiait au départ la digestion du chien). Le schéma canonique, avec son vocabulaire :

  • La nourriture est un stimulus inconditionnel (SI) : elle provoque naturellement, sans apprentissage, la salivation, qui est la réponse inconditionnelle (RI).
  • On associe de façon répétée un stimulus neutre — Pavlov utilisait une cloche (ou un métronome) — à l’arrivée de la nourriture.
  • Après quelques appariements, la cloche seule provoque la salivation : elle est devenue un stimulus conditionnel (SC), et la salivation qu’elle déclenche est la réponse conditionnelle (RC).

Les phénomènes associés :

  • L’extinction : si l’on fait sonner la cloche à plusieurs reprises sans jamais donner de nourriture, la réponse conditionnelle s’éteint.
  • La récupération spontanée : après une pause, la réponse éteinte peut réapparaître partiellement — preuve qu’elle n’avait pas été effacée, seulement inhibée.
  • La généralisation : la réponse s’étend à des stimuli ressemblants. C’est l’objet de l’expérience la plus tristement célèbre du behaviorisme : le Petit Albert de Watson (1920). Watson conditionna un bébé (« Albert ») à craindre un rat blanc, en associant sa présentation à un grand bruit effrayant (SI). Albert se mit non seulement à craindre le rat (SC), mais généralisa sa peur à tout ce qui était blanc et poilu : un lapin, un chien, un manteau de fourrure, une barbe de Père Noël.

Les applications sont vastes : la genèse des phobies (une peur conditionnée), mais aussi leur cure par désensibilisation systématique (Joseph Wolpe : réexposer progressivement le patient au stimulus redouté, associé à la relaxation, pour éteindre la réponse). Le conditionnement classique explique aussi certains aspects de la faim, du désir sexuel et des fétiches (association d’un objet à l’excitation). Bloom évoque aussi son détournement dans Orange mécanique (le protagoniste conditionné à la nausée devant la violence).

Enfin, la vue moderne dépasse l’idée d’une simple association mécanique : le conditionnement est en réalité une forme de préparation (preparedness) ou de prédiction. Le SC n’est pas « collé » au SI : il l’annonce, il informe l’organisme de ce qui va arriver. Bloom illustre par l’image de l’enfant battu qui se recroqueville en anticipant le coup : il a appris que tel signe prédit la violence. Le conditionnement est donc une machine à détecter les régularités du monde, pas un réflexe aveugle.

3. Le conditionnement opérant (Skinner)

Le conditionnement opérant ne porte plus sur l’association de deux stimuli, mais sur le lien entre ce qu’un organisme fait et les conséquences de son action.

Son précurseur est Edward Thorndike et sa fameuse boîte à énigme (puzzle box) : un chat affamé enfermé doit actionner un mécanisme pour sortir et atteindre la nourriture. Thorndike observe que le chat n’a aucun éclair de compréhension (insight) : il tâtonne, gratte, se débat, actionne le levier par hasard, puis, essai après essai, il met de moins en moins de temps à sortir. C’est l’apprentissage par essais et erreurs. Thorndike en tire la loi de l’effet (law of effect) : une action suivie d’une conséquence satisfaisante tend à être répétée ; suivie d’une conséquence désagréable, elle tend à disparaître. Bloom souligne l’analogie avec la sélection naturelle : comme l’environnement « sélectionne » les organismes les plus adaptés, les conséquences « sélectionnent » les comportements qui marchent.

Skinner systématise tout cela (avec sa « boîte de Skinner »). Vocabulaire essentiel :

  • Renforcement positif : ajouter quelque chose d’agréable pour augmenter un comportement (donner une friandise).
  • Renforcement négatif : retirer quelque chose de désagréable pour augmenter un comportement (arrêter un bruit strident quand le rat appuie sur le levier). Bloom insiste : le renforcement négatif n’est PAS une punition — c’est une confusion fréquente. Le renforcement (positif ou négatif) augmente toujours un comportement ; la punition vise à le diminuer.
  • Le façonnage (shaping) : pour enseigner une conduite complexe qui n’apparaîtrait jamais spontanément, on renforce les approximations successives — on récompense d’abord tout ce qui va vaguement dans le bon sens, puis on resserre l’exigence. C’est ainsi qu’on apprend à un pigeon à faire un tour sur lui-même ou à jouer au ping-pong.
  • Renforçateurs primaires vs secondaires : un renforçateur primaire satisfait un besoin biologique direct (nourriture, eau). Un renforçateur secondaire n’a de valeur que par association apprise (le « bon chien ! », l’argent, les points). D’où les économies de jetons (token economies) : dans certains hôpitaux psychiatriques ou classes, on distribue des jetons échangeables contre des récompenses pour renforcer les bons comportements.
  • Les programmes de renforcement (schedules) : le renforcement peut être délivré selon un ratio (nombre de réponses) ou un intervalle (temps écoulé), et de façon fixe ou variable. Chaque combinaison produit un rythme de réponse caractéristique.

Le phénomène le plus contre-intuitif est l’effet de renforcement partiel (partial reinforcement effect) : un comportement renforcé de façon intermittente et imprévisible (programme à ratio variable) est beaucoup plus résistant à l’extinction qu’un comportement renforcé à chaque fois. Deux illustrations que Bloom affectionne : la machine à sous (on continue à jouer parce que le gain est aléatoire et rare — le joueur ne peut jamais être sûr que le prochain coup ne sera pas gagnant), et l’enfant qui harcèle son parent : s’il obtient « oui » une fois sur dix, ce renforcement partiel rend son comportement de supplication extrêmement tenace (bien plus que s’il obtenait toujours, ou jamais, satisfaction).

Applications

Le behaviorisme a nourri de vraies technologies du comportement : les économies de jetons en prison et en institution, l’apprentissage animal, et une foule d’applications de la vie quotidienne (élever un enfant, dresser un animal, se débarrasser d’une mauvaise habitude). Skinner a même imaginé, dans son roman utopique Walden Two et dans Par-delà la liberté et la dignité, une société entièrement conçue par ingénierie du renforcement.

⚠️ La chute du behaviorisme

Bloom raconte comment les trois thèses fondatrices ont été, l’une après l’autre, jugées fausses — c’est un magnifique cas d’esprit critique.

  1. Il existe des savoirs et des capacités innés. L’esprit n’est pas une table rase : le langage en particulier se développe selon des contraintes universelles qu’aucun renforcement n’explique. La thèse du « tout appris » est fausse.

  2. Parler d’états mentaux EST scientifique. L’anti-mentalisme repose sur un mauvais argument. La physique manipule quotidiennement de l’invisible (forces, champs, particules) sans cesser d’être une science : ce qui compte n’est pas que la chose soit observable directement, mais qu’elle ait des conséquences observables. Mieux : un ordinateur ne peut se comprendre que par référence à ses programmes internes (invisibles). Si l’on doit invoquer des états internes pour expliquer une machine, on peut légitimement le faire pour un esprit. La psychologie cognitive naissante enterre ainsi le tabou behavioriste.

  3. L’apprentissage a des contraintes propres à chaque espèce — le renforcement n’est même pas nécessaire. Deux découvertes cruciales :

    • Edward Tolman montre l’apprentissage latent : des rats qui explorent un labyrinthe sans aucune récompense apprennent tout de même sa structure — ils forment des cartes mentales (cognitive maps) — et le prouvent en filant droit vers la sortie dès qu’on introduit une récompense. Donc on apprend sans renforcement, et on se représente le monde (mentalisme !).
    • L’effet Garcia (John Garcia) : un rat associe très facilement un goût à une nausée survenue des heures plus tard, mais n’associe pas ce goût à un choc électrique, ni un signal visuel/sonore à la nausée. L’association n’est donc pas arbitraire : les animaux sont biologiquement préparés à apprendre certaines liaisons plutôt que d’autres (ce qui contredit l’idée behavioriste d’un apprentissage neutre et universel). De même, les phobies « préparées » portent bien plus facilement sur les serpents et les araignées (dangers ancestraux) que sur les prises électriques ou les voitures (dangers récents pourtant plus mortels).

Surtout, le coup de grâce théorique vient de Noam Chomsky, dans sa célèbre recension du livre Verbal Behavior de Skinner (A Review of B. F. Skinner’s Verbal Behavior, 1959). Chomsky montre que, appliquée à l’humain, la loi de l’effet est prise dans un dilemme : soit on garde aux mots « stimulus », « réponse » et « renforcement » leur sens technique précis — et alors la théorie est manifestement fausse (on apprend le langage sans renforcement systématique) ; soit on les étire pour couvrir tous les cas — et alors le « renforcement » devient si vague qu’il n’explique plus rien (dire qu’on fait une chose parce qu’elle est « renforçante » devient une tautologie vide, « trivialement vraie »). C’est exactement le même reproche d’infalsifiabilité que celui adressé à Freud : une théorie qui explique tout après coup n’explique rien.

Ce qui reste

Bloom, comme pour Freud, refuse le mépris facile. Le behaviorisme laisse un legs réel :

  • Il a découvert de vrais mécanismes d’apprentissage — l’habituation, le conditionnement classique, le conditionnement opérant existent bel et bien et sont universels chez les animaux.
  • Il a produit des techniques de dressage et de modification du comportement puissantes et éprouvées, précieuses pour les animaux, les jeunes enfants, et notamment dans l’accompagnement de l’autisme sévère (l’analyse appliquée du comportement, ABA, en descend directement).

La seule erreur du behaviorisme fut son impérialisme : ces mécanismes sont réels, mais ils n’expliquent tout simplement pas tout. Ils sont une pièce du puzzle, pas le puzzle entier.

🔗 Liens