GPT

Generative Pre-trained Transformer : l’architecture derrière la plupart des modèles de langage

GPT, pour Generative Pre-trained Transformer, désigne une famille de modèles de langage fondés sur l’architecture Transformer. Le nom est devenu si courant qu’il sert souvent à désigner l’IA générative en général.

Ce que les trois lettres disent

Generative : le modèle produit du texte plutôt que de le classer. Pre-trained : il a absorbé un corpus très large avant toute spécialisation. Transformer : l’architecture qui lui permet de peser les mots les uns par rapport aux autres.

Un nom propre devenu nom commun

GPT désigne à l’origine les modèles d’un seul éditeur. L’usage l’a étendu à toute la catégorie. Les modèles concurrents reposent sur la même architecture sans porter ce nom.

Ce que le sigle ne dit pas

Ni la version, ni l’endroit où le calcul se fait, ni ce que devient le texte envoyé. Ces trois questions sont pourtant les seules qui comptent au moment de confier un document à un modèle.

Ce qu’il faut en retenir

Le sigle nomme une architecture, pas un produit ni un niveau de qualité. Deux outils qui l’affichent peuvent être séparés par plusieurs générations.

Mise à jour : 31 août 2026