IA
Inférence
L’inférence est la phase où l’on utilise un modèle déjà entraîné pour produire une réponse. C’est le moment où le modèle « travaille » à chaque requête, par opposition à l’entraînement, où il apprend.
La distinction est concrète :
- l’entraînement se fait une fois, en amont, et coûte cher ;
- l’inférence se rejoue à chaque appel, et c’est elle qui détermine le coût et la latence à l’usage.
Quand vous interrogez un assistant IA, vous déclenchez une inférence, pas un nouvel apprentissage.