Les unités de lecture de l’IA

Un token, c’est quoi ?

Un token est un petit morceau d’information traité par un modèle. Dans un texte, ce morceau peut être un mot entier, une partie de mot, un espace ou un signe. L’IA transforme ces morceaux en nombres pour calculer la suite la plus probable.

Bonjour,commentallez-vous?Une segmentation possible pour illustrer le principe. Le découpage réel varie selon le modèle.

Voir ce qui entre dans la mémoire de travail

Que doit garder l’IA pour répondre ?

Choisissez une situation. La fenêtre de contexte rassemble ce que le modèle peut examiner au moment de produire sa réponse.

Une mémoire de travail limitée

La fenêtre de contexte n’est pas une mémoire infinie

Imaginez un bureau de taille limitée. L’IA peut travailler avec ce qui tient sur le bureau : votre demande, une partie de l’historique, les fichiers, les instructions du service et la réponse en cours.

Lorsque la limite est atteinte, le service doit refuser l’entrée, raccourcir certains éléments, résumer ou retirer des messages anciens. Le comportement exact dépend de l’outil.

Instructions du serviceVotre demandeMessages précédentsDocuments ou imagesRésultats d’outilsRéponse à produire

Tout partage la même place disponible.

Ne pas confondre

Mot, token, contexte et mémoire

Mot

Ce que nous lisons

Une unité naturelle pour une personne. Un mot ne correspond pas toujours à un seul token.

Token

Ce que le modèle découpe

Un fragment de texte ou d’un autre média converti en représentation numérique.

Contexte

Ce que le modèle voit maintenant

L’ensemble limité des informations disponibles pour générer la réponse actuelle.

Mémoire

Ce que le service peut conserver

Une fonction éventuelle du produit. Elle n’est pas identique à la fenêtre de contexte et doit être vérifiée dans les réglages.

Pourquoi les tokens comptent

Longueur, capacité et coût

Les tokens servent notamment à mesurer la quantité traitée par un modèle. Ils influencent trois aspects différents.

1. La place disponible

Entrée et sortie doivent tenir dans les limites prévues par le modèle et le service.

2. Le temps de traitement

Davantage de contenu peut demander plus de calcul et ralentir la réponse.

3. Certains tarifs professionnels

Les API facturent souvent séparément les tokens envoyés et ceux qui sont générés.

Mieux utiliser le contexte

Six habitudes simples

1

Rappeler l’objectif

Après une longue discussion, reformulez brièvement le résultat attendu.

2

Nettoyer les documents

Retirez les annexes et pages sans rapport avec la tâche.

3

Donner les priorités

Indiquez les règles importantes plutôt que de compter sur un ancien message.

4

Demander une synthèse

Avant de poursuivre, faites résumer les décisions et vérifiez-les.

5

Ouvrir une nouvelle conversation

Quand le sujet change, repartez avec un contexte court et propre.

6

Ne pas confier un secret

Une grande capacité de contexte ne garantit ni confidentialité ni effacement.

Trois idées à corriger

Ce que les tokens ne disent pas

« Un token est toujours un mot. »

Non. Il peut représenter un mot, une partie de mot, un signe ou un autre type d’information.

« Une grande fenêtre signifie que l’IA comprend tout parfaitement. »

Non. Une information peut être présente mais mal utilisée, noyée ou contradictoire.

« Le chatbot se souvient forcément de toutes nos conversations. »

Non. L’historique visible, le contexte utilisé et une éventuelle mémoire du service sont trois choses différentes.

Sources techniques

Pour vérifier les notions

Les limites exactes changent selon les modèles. Consultez toujours la documentation du service utilisé pour connaître sa capacité et son mode de comptage.

Google for DevelopersTokens et modèles de langage →OpenAICapacités et fenêtres de contexte →OpenAI APIUsage et limites de tokens →

Sources consultées le 26 septembre 2026.

La suite logique

Voyez maintenant comment les tokens peuvent influencer un coût.

Comprendre les coûts

Comprendre une notion

Gardez le fil de votre apprentissage.

Une étape courte et clairement reliée à ce que vous venez de lire.