voyage aléatoire au détour du Web

Étiquette : llm

Informatique

Un million de tokens

Quand on parle Intelligence Artificielle on évoque inévitablement le mot token. Découvrez à travers cette animation promotionnelle, à quoi correspondent un million de tokens.

AnnéeModèle / moteurOrganisationContexte maximal approximatifParticularité
2018GPT‑1OpenAI512 tokensPremier modèle GPT majeur
2019GPT‑2OpenAI1 024 tokensForte amélioration de la génération de texte
2020GPT‑3OpenAI2 048 tokens175 milliards de paramètres
2022ChatGPT — GPT‑3.5OpenAI4 096 puis 16 385 tokensPopularisation des assistants conversationnels
2022LaMDAGoogleEnviron 8 000 tokensModèle spécialisé dans le dialogue
2023GPT‑4OpenAI8 192 puis 32 768 tokensRaisonnement et compréhension améliorés
2023Claude 1.3Anthropic100 000 tokensPremière très grande fenêtre de contexte
2023Claude 2Anthropic100 000 tokensModèle conversationnel long contexte
2023Llama 2Meta4 096 tokensModèle à poids ouverts largement diffusé
2023GPT‑4 TurboOpenAI128 000 tokensContexte beaucoup plus long
2023Claude 2.1Anthropic200 000 tokensDoublement de la fenêtre de Claude
2024Gemini 1.5 ProGoogle1 à 2 millions de tokensTrès grande capacité documentaire
2024GPT‑4oOpenAI128 000 tokensTexte, image, audio et interaction temps réel
2024Claude 3.5 SonnetAnthropic200 000 tokensRaisonnement et programmation améliorés
2024Llama 3.1Meta128 000 tokensModèle ouvert avec long contexte
2024Mistral Large 2Mistral AI128 000 tokensModèle européen performant en texte et code
2025GPT‑4.1OpenAI1 000 000 tokensLong contexte et programmation
2025Llama 4 ScoutMetaJusqu’à 10 000 000 tokensTrès grande fenêtre de contexte
2025Llama 4 MaverickMetaEnviron 1 000 000 tokensModèle multimodal à poids ouverts
2025DeepSeek‑R1DeepSeekEnviron 128 000 tokensModèle orienté raisonnement
2025Mistral Large 3Mistral AI256 000 tokensModèle multimodal à poids ouverts
2026Modèles de nouvelle générationPlusieurs acteursJusqu’à environ 1 000 000 tokensModèles orientés agents, code et raisonnement

Les jalons les plus importants sont le passage de 2 048 tokens pour GPT‑3 en 2020 à 128 000 tokens pour GPT‑4 Turbo en 2023, puis à 1 à 2 millions de tokens avec Gemini 1.5 en 2024. Les modèles ouverts ont ensuite fortement progressé, notamment avec Llama 4 Scout et sa fenêtre annoncée jusqu’à 10 millions de tokens. Ce n’est pas pour autant que ces modèles sont plus intelligents. Cela représente un marqueur pour le volume de texte qui peut être utilisé par un moteur.

Source : Wikipedia, LLM Context Window Growth Timeline

Continue reading →
Back to top