Ce que nous lisons
Une unité naturelle pour une personne. Un mot ne correspond pas toujours à un seul token.
Les unités de lecture de l’IA
Un token est un petit morceau d’information traité par un modèle. Dans un texte, ce morceau peut être un mot entier, une partie de mot, un espace ou un signe. L’IA transforme ces morceaux en nombres pour calculer la suite la plus probable.
Voir ce qui entre dans la mémoire de travail
Choisissez une situation. La fenêtre de contexte rassemble ce que le modèle peut examiner au moment de produire sa réponse.
Une mémoire de travail limitée
Imaginez un bureau de taille limitée. L’IA peut travailler avec ce qui tient sur le bureau : votre demande, une partie de l’historique, les fichiers, les instructions du service et la réponse en cours.
Lorsque la limite est atteinte, le service doit refuser l’entrée, raccourcir certains éléments, résumer ou retirer des messages anciens. Le comportement exact dépend de l’outil.
Tout partage la même place disponible.
Ne pas confondre
Une unité naturelle pour une personne. Un mot ne correspond pas toujours à un seul token.
Un fragment de texte ou d’un autre média converti en représentation numérique.
L’ensemble limité des informations disponibles pour générer la réponse actuelle.
Une fonction éventuelle du produit. Elle n’est pas identique à la fenêtre de contexte et doit être vérifiée dans les réglages.
Pourquoi les tokens comptent
Les tokens servent notamment à mesurer la quantité traitée par un modèle. Ils influencent trois aspects différents.
Entrée et sortie doivent tenir dans les limites prévues par le modèle et le service.
Davantage de contenu peut demander plus de calcul et ralentir la réponse.
Les API facturent souvent séparément les tokens envoyés et ceux qui sont générés.
Mieux utiliser le contexte
Après une longue discussion, reformulez brièvement le résultat attendu.
Retirez les annexes et pages sans rapport avec la tâche.
Indiquez les règles importantes plutôt que de compter sur un ancien message.
Avant de poursuivre, faites résumer les décisions et vérifiez-les.
Quand le sujet change, repartez avec un contexte court et propre.
Une grande capacité de contexte ne garantit ni confidentialité ni effacement.
Trois idées à corriger
Non. Il peut représenter un mot, une partie de mot, un signe ou un autre type d’information.
Non. Une information peut être présente mais mal utilisée, noyée ou contradictoire.
Non. L’historique visible, le contexte utilisé et une éventuelle mémoire du service sont trois choses différentes.
Sources techniques
Les limites exactes changent selon les modèles. Consultez toujours la documentation du service utilisé pour connaître sa capacité et son mode de comptage.
Sources consultées le 26 septembre 2026.
La suite logique
Comprendre une notion
Une étape courte et clairement reliée à ce que vous venez de lire.