L’alignement désigne le travail qui consiste à faire correspondre le comportement d’un modèle aux intentions de ceux qui l’emploient : refuser ce qui doit l’être,…
La distillation consiste à entraîner un modèle réduit en lui faisant reproduire les réponses d’un modèle beaucoup plus gros. Le petit hérite d’une part du…
Les garde-fous sont les limites posées autour d’un modèle : sujets refusés, formats imposés, contrôle de ce qui entre et de ce qui sort. Ils…
L’apprentissage par renforcement entraîne un modèle en le laissant essayer, puis en récompensant ce qui va dans le bon sens. Personne ne lui fournit la…
GPT, pour Generative Pre-trained Transformer, désigne une famille de modèles de langage fondés sur l’architecture Transformer. Le nom est devenu si courant qu’il sert souvent…
Un deepfake, ou hypertrucage, est un enregistrement fabriqué par un modèle qui reproduit le visage ou la voix d’une personne réelle. Il sert de plus…
