LLM : définition et fonctionnement de l’IA générative

temps de lecture 7 minutes

Derrière les prouesses de ChatGPT, Gemini ou Claude se cache une technologie fascinante appelée LLM, pour Large Language Model. Entre révolution technique et limites bien réelles, nous décryptons le fonctionnement de ces moteurs qui réinventent notre façon d'interagir avec les machines.

Crédits : Unsplash

ChatGPT, Gemini, Claude... Ces noms font désormais partie de notre quotidien numérique. Pourtant, derrière ces interfaces de discussion simples et épurées se cache un monstre de technologie. Ce moteur, c'est le LLM, ou Large Language Model (que l'on traduit en français par grand modèle de langage). Ce système informatique est conçu pour comprendre, manipuler et générer du langage humain de manière fluide. Pour comprendre sa portée, on peut voir ces modèles comme d'immenses bibliothèques numériques, entraînées sur des quantités massives de textes issus du web, de livres et d'encyclopédies.

Un grand modèle de langage s'appuie sur des algorithmes d'apprentissage profond (le « deep learning », une méthode où la machine apprend seule en analysant d'énormes volumes de textes) pour accomplir une multitude de tâches linguistiques. L'avènement de cette technologie marque une rupture historique. Auparavant, les ordinateurs se contentaient d'analyser les textes de façon rigide, mot par mot, sans en saisir la substance. Aujourd'hui, l'intelligence artificielle générative traite le langage de façon globale, en appréhendant le contexte général de nos demandes. Les LLM sont les premiers outils informatiques capables de traiter le langage humain courant à grande échelle. Ces modèles servent déjà à automatiser des tâches administratives, rédiger des comptes rendus ou écrire du code informatique.

Le secret de l'architecture Transformer et de la prédiction statistique

Pour comprendre comment fonctionne réellement cette intelligence, il faut regarder ce qui se passe à l'intérieur. Contrairement à une idée reçue, un grand modèle de langage ne « pense » pas et ne comprend pas le sens des mots comme le ferait un humain. Il s'agit en réalité d'une gigantesque machine de prédiction statistique. Sa mission ? Deviner le mot suivant le plus probable dans une phrase donnée. Pour y parvenir, la machine s'appuie sur une innovation majeure née en 2017, l'architecture Transformer, mise au point par des chercheurs de Google (c'est le fameux « T » de GPT).

Crédits : Unsplash

Les modèles basés sur les Transformers traitent l'information dans son ensemble, en parallèle, et non mot après mot. Le système découpe d'abord le texte en petits morceaux de mots (ce qu'on appelle les « tokens », les unités de base du langage machine) puis les convertit en vecteurs numériques. Grâce à un mécanisme mathématique sophistiqué baptisé « auto-attention », l'intelligence artificielle parvient à mesurer la force des relations entre les mots d'une même phrase, même s'ils sont très éloignés. Ce mécanisme permet au modèle de garder le fil d'une conversation.

Pour entraîner ces modèles, les concepteurs leur font ingurgiter des montagnes de données textuelles provenant d'Internet, d'encyclopédies et de livres numérisés. C'est durant cette phase d'entraînement, qui nécessite la puissance de milliers de processeurs graphiques ultra-performants, que l'IA va ajuster ses milliards de « paramètres », sorte de curseurs de réglage internes permettant d'affiner la précision de ses prédictions. On parle d'ailleurs de « grand » modèle justement à cause de ces paramètres, qui se comptent au minimum en milliards.

Autre limite à connaître, les connaissances d'un modèle s'arrêtent à la date de fin de son entraînement. Interrogé sur un événement plus récent, il répondra soit qu'il n'en sait rien, soit avec des informations dépassées. Sauf si l'outil est autorisé à aller consulter le web en direct, ce que proposent aujourd'hui la plupart des assistants grand public.

Les limites incontournables : l'absence d'esprit critique et les hallucinations

Cette fluidité d'écriture ne doit pas masquer les faiblesses inhérentes à ces technologies. Puisque le grand modèle de langage se contente de calculer des probabilités de mots, il n'a aucune notion de la vérité scientifique ou de la moralité. Cela explique le phénomène de l'hallucination : l'IA peut affirmer une énormité ou inventer une référence historique avec un aplomb déconcertant, simplement parce que la structure de sa phrase paraît statistiquement parfaite.

Ce manque de discernement impose de garder une vigilance constante. Le cas de l'apprentissage des langues étrangères avec l'IA le montre bien. Il ne faut jamais prendre pour argent comptant la réponse d'un robot conversationnel. De la même façon, imaginer générer un mot de passe robuste par le biais d'un chatbot est une fausse bonne idée : l'IA produit des suites de caractères beaucoup trop prévisibles pour les logiciels des pirates. Face à ces risques de désinformation et d'erreurs, certaines institutions ont pris des mesures radicales. À titre d'exemple, l'encyclopédie collaborative Wikipédia a banni l'IA de la rédaction de ses articles dans sa version anglophone, pour préserver la fiabilité de ses contenus. Quelques usages restent tolérés sous conditions, comme la correction de forme d'un texte écrit par le contributeur ou l'aide à la traduction.

Ces biais et ces approximations viennent du fait que l'IA reproduit les données sur lesquelles elle a été entraînée, préjugés et erreurs humaines compris. Pour tenter d'optimiser ces modèles tout en réduisant leur consommation d'énergie, les ingénieurs utilisent parfois des techniques avancées comme le procédé de distillation en intelligence artificielle. Cette méthode consiste à transférer le savoir d'un modèle géant vers un modèle beaucoup plus petit et plus économe, même si cela soulève parfois d'épineuses questions éthiques et juridiques sur la propriété intellectuelle des données.

De l'écran à notre quotidien : des outils en constante mutation

Les grands modèles de langage ne se cantonnent plus aux seuls laboratoires de recherche. Ils irriguent désormais la quasi-totalité des services numériques que nous utilisons au quotidien. Pour les utilisateurs, le choix est vaste, d'autant que le marché se structure entre gratuité et abonnements premium. Prendre le temps d'analyser les différences entre ChatGPT gratuit et payant permet de cibler le niveau de performance requis pour vos besoins personnels ou professionnels, les versions payantes offrant généralement un accès prioritaire à des modèles de langage plus récents et beaucoup plus rapides.

Cette démocratisation de l'intelligence artificielle s'accélère également grâce au matériel informatique. L'IA ne se limite plus aux ordinateurs, elle s'installe dans des objets que l'on porte sur soi. C'est notamment le cas pour les lunettes connectées équipées d'intelligence artificielle, qui permettent d'interroger un LLM d'une simple commande vocale pour analyser l'environnement qui nous entoure ou traduire des panneaux à la volée. Avec ces appareils, l'IA quitte l'écran du navigateur pour devenir un assistant qui voit et entend en même temps que nous.

L'utilisateur doit garder à l'esprit qu'un grand modèle de langage reste un assistant de rédaction et d'idéation, dont les réponses peuvent contenir des erreurs. En apprenant à formuler des instructions claires (les fameux « prompts ») et en vérifiant systématiquement les informations clés générées par ces algorithmes, chacun peut profiter de la puissance de calcul de ces outils tout en évitant les pièges de la désinformation. Bien utilisée, l'intelligence artificielle fait gagner du temps sur la rédaction et la recherche d'idées, à condition que l'humain garde le dernier mot.

publié le , William Zimmer de Humanoid

Ailleurs sur le web