Testothèque
/

N-back Task

N-back Task

n-back

Passer l'outil
Passer l'outil

T

Type

test

D

Domaine

Fonctions exécutives

Âge

>12

Durée

9 min

Normes

Disponibles

Description

Général

La tâche N-Back visuelle est l'outil de référence en psychologie et en neurosciences cognitives pour évaluer la mise à jour (updating) en mémoire de travail. Elle ne doit pas être confondue avec un simple test de mémoire (comme l'empan de chiffres) : elle exige un processus dynamique continu d'encodage, de maintien, de comparaison et de suppression de l'information.

Le participant voit défiler une série de lettres et doit décider, pour chacune, si elle est identique à celle présentée N étapes plus tôt. La difficulté est progressive (paramétrique) :

  1. 0-Back (attention) : Le participant doit répondre si la lettre est une cible prédéfinie (« X »). Charge mnésique nulle.
  2. 1-Back (maintien) : Le participant compare la lettre actuelle avec la précédente. Charge mnésique faible.
  3. 2-Back (mise à jour) : Le participant compare avec la lettre vue 2 étapes avant. C'est le standard clinique pour la mémoire de travail active.

Chaque niveau est précédé d'un bloc d'entraînement avec feedback (12, 12 et 15 essais) suivi d'un bloc de test sans feedback (40 essais par niveau), soit 120 essais de test. Les conditions se suivent en ordre croissant fixe (0, 1, 2), comme chez Lamichhane et al. (2020) : la charge est donc confondue avec le temps passé sur la tâche, ce qui concerne directement les scores de coût 0→2. La réponse est de type Go/No-Go : ESPACE pour une cible, aucune réponse sinon — Miller et al. (2009), d'où vient le repère de 80 %, utilisent un choix forcé à deux touches, format dans lequel la précision n'est pas sur la même échelle. La casse des lettres varie aléatoirement à chaque présentation, ce qui impose un appariement sur l'identité de la lettre et non sur sa forme. La condition 2-Back inclut des leurres (lettre identique à la position N−1), qui testent l'inhibition de la familiarité.

Propriétés psychométriques

À lire avant d'interpréter un score : la littérature fournie avec l'outil est critique envers le N-Back comme mesure individuelle.

Fidélité
  • Test-retest : aucune des études fournies ne rapporte de fidélité test-retest pour le N-Back. Les seuls coefficients disponibles sont intra-session (cohérence interne de type split-half), d'une nature différente. Aucun chiffre ne peut donc être avancé ici, et le N-Back ne doit pas être présenté comme un marqueur de trait stable.
Validité
  • Validité de construit : la tâche active le réseau fronto-pariétal, mais Miller et al. (2009) — étude fournie avec l'outil — concluent que « les résultats ne soutiennent pas la validité du N-Back comme mesure pure de la mémoire de travail » et recommandent de conserver l'empan en pratique clinique.
  • Convergence : les deux études fournies sont en désaccord, et ce désaccord porte précisément sur ce point. Schmiedek, Lövdén et Lindenberger (2014) — fournie avec l'outil — est un commentaire écrit pour réfuter la conclusion de Redick et Lindsey (2013) selon laquelle « complex span and n-back tasks cannot be used interchangeably ». Ils rappellent que la corrélation observée de r = 0,20 entre indicateurs dissemblables ne prouve ni l'existence ni l'absence d'un construit commun, puisqu'une performance contient aussi de l'erreur de mesure et de la variance spécifique à la tâche et au paradigme ; sur 101 adultes jeunes et 103 adultes âgés et neuf tâches, leurs données sont « consistent with a hierarchical model of working memory, according to which both complex span and n-back tasks are valid indicators of working memory ». La méta-analyse de Redick et Lindsey n'est pas fournie avec l'outil : elle n'est connue ici qu'à travers cette réponse.
  • Usage recommandé : comparaison intra-individuelle des trois charges au sein d'une même passation, plutôt que lecture d'un score isolé. C'est la recommandation qui survit au désaccord ci-dessus : que le N-Back mesure ou non le même construit que l'empan, la variance spécifique à la tâche et au paradigme s'annule en grande partie lorsqu'on compare 0, 1 et 2-Back chez la même personne, et pas lorsqu'on lit un score unique.
Interprétation clinique

L'analyse repose sur la théorie de la détection du signal (d') pour distinguer la vraie capacité mnésique des biais de réponse. Trois profils types :

  • Ralentissement cognitif (ex. : dépression, Parkinson) : Précision (d') correcte mais temps de réaction très élevé, augmentant disproportionnellement avec la charge (0 → 2).
  • Déficit de mise à jour (ex. : schizophrénie, vieillissement) : Effondrement de la précision (d') en condition 2-Back, alors que le 0-Back et le 1-Back sont préservés. Difficulté à gérer les interférences.
  • Déficit attentionnel (ex. : TDAH) : Performance fluctuante dès le 0-Back, nombreuses omissions, variabilité du TR.

Normes

Aucune norme populationnelle n'est disponible pour cette implémentation : les 33 indices affichés sont rapportés en score brut. Ce sont, par niveau (0, 1, 2) : précision, d', critère (c), taux de détection, taux de fausses alarmes, TR moyen, écart-type du TR, coefficient de variation du TR et taux d'omissions — soit vingt-sept ; plus le taux d'erreurs sur les leurres (2-back), les trois coûts cognitifs 0→2 (TR, précision, d') et les deux indices d'anticipation. L'écart-type et le CV du TR sont définis exactement comme ceux de l'ANT (écart-type d'échantillon, diviseur n−1 ; CV = écart-type / moyenne × 100), afin d'être lus côte à côte avec eux. Le critère, le taux de détection et le taux de fausses alarmes portent chacun une carte et figurent dans l'export : ils ne s'interprètent pas isolément, ils servent à lire le d', qui les résume. Un indice calculé sur un ensemble vide n'est pas publié à 0 : il est omis, et sa carte indique « Réponses manquantes » — un niveau sans aucune cible, par exemple, ne donne ni taux de détection ni d'. L'interprétation est intra-individuelle et repose sur les indicateurs de validité ci-dessous.

Indicateurs de validité de la passation
  • Performance 0-Back : le critère d'interprétabilité porte sur le d' (discrimination au-dessus du hasard, seuil dérivé du plan expérimental) ; une précision 0-Back sous 80 % déclenche un avertissement complémentaire, repère tiré de Miller et al. (2009) (témoins : 95,9 %).
  • Pattern de charge : La précision doit diminuer logiquement avec la charge (0 > 1 > 2). Un pattern inverse invalide la passation.
  • Biais de réponse (c) : Permet de voir si le patient répond « oui » au hasard ou s'il est trop prudent. Un d' proche de 0 avec un c très négatif signe une réponse systématique plutôt qu'une performance.
Avertissement clinique essentiel

Le N-Back est un outil de MESURE COGNITIVE, pas de DIAGNOSTIC. Un d' effondré en 2-Back oriente vers un déficit de mise à jour mais ne distingue pas à lui seul son étiologie. Les scores doivent être lus conjointement aux indicateurs de validité ci-dessus : une précision 0-Back insuffisante rend les niveaux supérieurs ininterprétables.

References

Article original Kirchner, W. K. (1958). Age differences in short-term retention of rapidly changing information. Journal of Experimental Psychology, 55(4), 352-358.

Clinique & psychométrie Miller, K. M., Price, C. C., Okun, M. S., Montijo, H., & Bowers, D. (2009). Is the n-back task a valid neuropsychological measure for assessing working memory? Archives of Clinical Neuropsychology, 24(7), 711-717.

Psychométrie Schmiedek, F., Lövdén, M., & Lindenberger, U. (2014). A task is a task is a task: putting complex span, n-back, and other working memory indicators in psychometric context. Frontiers in Psychology, 5, 1475.

Processus cognitifs Rac-Lubashevsky, R., & Kessler, Y. (2016). Decomposing the n-back task: An individual differences study using the reference-back paradigm. Neuropsychologia, 90, 190-199.