Juge LLM
Aussi : LLM-as-a-judge · modèle juge · évaluateur LLM
Employer un modèle pour évaluer automatiquement des sorties selon des critères.
Le juge LLM emploie un modèle pour noter ou comparer des sorties selon une grille de critères explicites : exactitude, respect du format, ton, pertinence. Il permet d'évaluer de gros volumes bien plus vite qu'une relecture humaine intégrale.
C'est le moteur de la QA scorée à l'échelle. Sur une production de masse, aucune équipe ne relit tout : le juge filtre, priorise et signale ce qui mérite un œil humain. Il transforme un jugement qualitatif en note comparable dans le temps.
Il se calibre sur des exemples annotés et s'audite régulièrement, car il peut hériter de biais ou se laisser tromper par la forme — un texte creux mais bien tourné. On croise donc son verdict avec des règles automatiques et des guardrails pour éviter de valider du slop élégant.

Besoin d’appliquer ce concept sur un cas concret ?
Parler de votre prochaine mission