Elle a appris en lisant énormément de textes
L'apprentissage, avant de pouvoir répondre
Avant de pouvoir répondre à une question, une IA comme ChatGPT ou Claude passe par une étape appelée l'entraînement. Pendant cette étape, qui dure des semaines et coûte très cher, le programme "lit" une quantité gigantesque de textes (livres, sites internet, articles), et ajuste progressivement sa façon de deviner quel mot vient logiquement après un autre.
Une fois cet entraînement terminé, l'IA est "figée" : quand vous lui parlez, elle ne va pas lire internet en direct pour vous répondre (sauf si on lui donne spécifiquement un outil de recherche web). Elle utilise ce qu'elle a mémorisé pendant son entraînement.
Une comparaison simple : l'apprenti qui a lu toute une bibliothèque
Imaginez un apprenti qui, avant de commencer à travailler, aurait lu l'intégralité d'une immense bibliothèque : encyclopédies, romans, manuels techniques, forums de discussion. Il n'a pas vécu ces événements, mais il a lu tellement d'exemples de la façon dont les gens s'expriment sur chaque sujet qu'il peut, ensuite, produire des réponses qui ressemblent à ce qu'un humain compétent aurait écrit.
Sa connaissance s'arrête au dernier jour où il a pu lire (on parle de "date de coupure des connaissances") : si un événement s'est produit après cette date, il ne le connaît pas, sauf si on le lui explique dans la conversation ou qu'on lui donne un accès à internet.
Cas concret
Une personne demande à une IA "quel temps fait-il aujourd'hui à Lyon ?". Sans accès à internet en direct, l'IA ne peut pas connaître la météo du jour : ce n'était pas dans les textes qu'elle a lus pendant son entraînement, et la météo change en permanence. Elle va soit dire qu'elle ne sait pas, soit (si elle est mal conçue ou mal utilisée) inventer une réponse plausible mais fausse.
Erreurs fréquentes
- Croire que l'IA "sait tout, en temps réel" : sans un outil de recherche web activé, elle ne connaît que ce qu'elle a appris pendant son entraînement, à une date donnée.
- Penser qu'elle apprend automatiquement de chaque conversation : en général, une conversation avec une IA ne modifie pas ce qu'elle a appris pour les autres utilisateurs.
- Confondre "a lu énormément" avec "a tout compris" : elle reproduit des motifs de langage, elle ne vérifie pas chaque fait comme le ferait un expert humain.
À retenir
- Une IA générative apprend pendant une phase d'entraînement, en lisant une quantité massive de textes.
- Après cet entraînement, ses connaissances sont figées à une date donnée, sauf si elle a un accès spécifique à internet.
- Elle ne "vit" pas les événements : elle reproduit des façons d'écrire qu'elle a observées dans ses données d'apprentissage.
Mini-exercice
Une IA sans accès à internet peut-elle vous dire le score du match de football d'hier soir ?
Réponse : non, pas de façon fiable. L'événement a eu lieu après la fin de son entraînement (ou en dehors de ce qu'elle a appris), donc elle ne peut pas le connaître avec certitude, sauf si elle dispose d'un outil de recherche web pour aller vérifier l'information en direct.