Comment fonctionne un modèle de langage : tokens, fenêtre de contexte et température
Ce qu’est un token, ce que limite la fenêtre de contexte, ce que fait la température et pourquoi les modèles se trompent avec aplomb. Expliqué sans maths.
Catégorie
L’IA générative a changé la façon d’écrire du code, de chercher de l’information et d’automatiser des tâches. Dans cette catégorie, nous expliquons les concepts sous-jacents (modèles de langage, tokens, contexte, agents) et comment utiliser ces outils avec discernement.
Nous évitons les promesses creuses. Quand une affirmation dépend de la documentation ou d’une annonce d’un éditeur, nous renvoyons à la source originale, et nous signalons les limites aussi clairement que les avantages.
Ce qu’est un token, ce que limite la fenêtre de contexte, ce que fait la température et pourquoi les modèles se trompent avec aplomb. Expliqué sans maths.
Pourquoi les modèles facturent au token, comment compter exactement pour GPT et approximativement pour Claude, et comment réduire le coût de chaque appel.
Un agent IA combine un modèle de langage, des outils et une boucle de décision pour accomplir des tâches. Différences avec un chatbot, fonctionnement et risques.