Phase où le modèle d’IA produit une réponse à partir d’une question. C’est le moment où l’IA « travaille » : elle reçoit votre texte et génère sa réponse, mot par mot.
Inférence
L'inférence est la phase où le modèle d'IA produit une réponse à partir d'une question. C'est le moment où l'IA « travaille » : elle reçoit votre texte et génère sa réponse, mot par mot. Cette étape mobilise la puissance de calcul à chaque utilisation du modèle, contrairement à l'entraînement.