Aller au contenu
S Sampre-AI
Menu

IA

Inférence

L’inférence est la phase où l’on utilise un modèle déjà entraîné pour produire une réponse. C’est le moment où le modèle « travaille » à chaque requête, par opposition à l’entraînement, où il apprend.

La distinction est concrète :

  • l’entraînement se fait une fois, en amont, et coûte cher ;
  • l’inférence se rejoue à chaque appel, et c’est elle qui détermine le coût et la latence à l’usage.

Quand vous interrogez un assistant IA, vous déclenchez une inférence, pas un nouvel apprentissage.

Voir aussi

← Retour au lexique