Leçon 3 : c'est quoi l'inférence ? — L'intuition, sans code
Tu n'as pas besoin de savoir programmer ni de connaître les GPU pour commencer — cette leçon ne contient pas une seule ligne de code. On part de la grande idée : un modèle d'IA a deux vies. On l'entraîne d'abord (une fois, lentement), puis on le fait tourner encore et encore pour obtenir des réponse
L'entraînement, c'est apprendre une recette en goûtant et en corrigeant, une seule fois. L'inférence, c'est déjà cuisiner cette recette terminée encore et encore — sans la changer, aussi vite que possible.
- Inférence
- L'étape où on fait tourner un modèle déjà entraîné sur une nouvelle entrée pour obtenir une prédiction. Rien dans le modèle ne change — on obtient juste une réponse.
- Entraînement
- L'étape d'apprentissage : le modèle voit beaucoup d'exemples étiquetés, se trompe et se corrige jusqu'à ce qu'il « sache ». Ça arrive une fois et ça prend du temps.
- Prédiction
- La réponse que le modèle renvoie pour une nouvelle entrée — par exemple « spam » ou « pas spam », « chat » ou « chien ».