Concept LLM & agents

Inférence / Inference

Que veut dire « Inférence / Inference » dans le jargon de l’IA ?

Le moment où le modèle produit une réponse à partir d'une entrée. C'est l'usage courant, par opposition à l'entraînement. En local, l'inférence consomme votre GPU.

Autres formes : inference, inférence, Inférence.

L'inférence est la phase d'usage d'un modèle déjà entraîné : il reçoit une entrée et produit une sortie, sans que ses paramètres internes changent. C'est ce qui se passe à chaque appel, par opposition à l'entraînement ou au fine-tuning.

Exemple d’usage : Une relecture d'article a corrigé une confusion fréquente : l'inférence, la génération de tokens un par un lors de l'utilisation du modèle, n'est pas aussi parallélisable que le laisse penser la comparaison avec l'entraînement ou le traitement initial du prompt.

Concepts associés

Concept LLM & agents Claude Découvrir → Concept LLM & agents vLLM Découvrir →

Vous ne comprenez rien à ce charabia, mais vous avez envie d’améliorer vos utilisations informatiques ? Contactez-moi.

Chaque situation est différente : dites-moi où vous en êtes, on regarde ensemble ce qui a du sens pour vous.

Me contacter

Un premier échange, sans engagement, pour comprendre où vous en êtes.

Racontez votre expérience

Comment ce concept intervient-il dans vos usages ? Partagez un exemple : les contributions sont relues avant publication.

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *