← Lexique

Context window

Aussi : fenêtre de contexte · context length

Quantité maximale de tokens que le modèle traite en une seule requête.

La fenêtre de contexte est le nombre maximal de tokens que le modèle traite d'un seul tenant. Elle est partagée entre tout ce qu'on lui donne — instruction de cadrage, consignes, documents, historique — et la réponse à produire.

C'est une contrainte structurante en récupération. Elle borne le nombre de sources citables qu'on peut fournir et la longueur d'un contenu traité en une passe. Trop la remplir dilue l'attention du modèle et fait grimper coût et latence, sans garantir une meilleure réponse.

On gère la fenêtre comme un budget : hiérarchiser les passages via le reranking, découper les longs contenus en chunks, résumer ce qui peut l'être. Suivre le taux de remplissage évite les troncatures silencieuses qui amputent une réponse ou écartent une source décisive.

Instructions, sources et réponse partagent un même budget de tokens.
Ce qui occupe la fenêtreDonnées anonymisées

Besoin d’appliquer ce concept sur un cas concret ?

Parler de votre prochaine mission