LLM

De Wiki du Numérique Responsable

Un LLM (large language model, modèle de langage de grande taille) est un modèle entraîné sur de très grands volumes de texte, capable de produire et de traiter du langage naturel.

Il constitue le socle des services d’IA générative grand public.

Ce qu’il fait, et ce qu’il ne fait pas

Un LLM prédit la suite d’une séquence de texte. Il ne consulte pas de base de connaissances, ne vérifie rien et n’a pas de notion d’exactitude, d’où les hallucinations.

Coût

L’entraînement mobilise des ressources considérables, mais l’inférence répétée finit par dominer le bilan d’un service en production. Le choix de la taille du modèle est donc l’arbitrage principal : un modèle plus petit, spécialisé, répond souvent au besoin pour une fraction du coût.

Voir aussi