Définition·
Fondamentaux

Fenêtre de contexte

Nombre maximal de tokens qu'un modèle peut considérer à la fois en entrée et en sortie.

Explication détaillée

La fenêtre de contexte conditionne ce qu'un LLM peut "voir" : conversation, documents joints, instructions système. Plus elle est grande, plus on peut injecter de contenu (ex. RAG), au prix d'un coût et d'une latence accrus. Les modèles récents atteignent plusieurs centaines de milliers de tokens.

Exemples

Claude 3.5 Sonnet : 200k tokens
Gemini 1.5 Pro : 1M+ tokens
GPT-4 Turbo : 128k tokens

Questions fréquentes

Plus c'est grand, mieux c'est ?

Pas toujours : au-delà d'une certaine taille, la qualité de rappel baisse et le coût grimpe. Le RAG reste utile.

Termes associés

Dernière mise à jour : 15/07/2026

Talent AI

Passez de la théorie à la pratique

Publiez une mission ou rejoignez la communauté des meilleurs experts IA, Data et Machine Learning.