Évaluation d'agent
Définition
L'évaluation d'agent est le dispositif intégré de Macha pour noter la façon dont un agent a réellement fait son travail. Un juge IA applique une grille de contrôle aux conversations passées de l'agent et indique, conversation par conversation, s'il a suivi ses instructions et pourquoi.
Comment cela fonctionne
Vous définissez une grille une fois — ou vous laissez Macha la construire à partir des instructions de l'agent — et un juge IA l'applique à toutes les conversations passées concernées : sessions de chat, exécutions autonomes déclenchées, délégations à des sous-agents, conversations du chatbot embarqué. Deux champs sont toujours présents : Instructions followed, le respect des instructions (Yes / Partially / No), et un bref Why, le motif du verdict. Vous ajoutez vos propres contrôles, du type « le bon outil a été appelé » ou « remboursement accordé uniquement lorsque la politique l'autorisait ».
Le score principal accorde un crédit partiel — le nombre de Yes plus la moitié des Partially, rapporté au total — et les résultats reviennent sous forme de tableau, de rapport avec graphiques et de motif par conversation, afin que vous puissiez auditer un verdict sans relire tout le fil.
Auto-Eval et évaluations manuelles
Chaque espace de travail dispose d'Auto-Eval gratuitement sur toutes les formules : dès la création d'un agent, Macha note chaque exécution autonome au regard de ses instructions en vigueur avec un juge prédéfini, sans plafond de conversations et sans coût. Les évaluations manuelles, également incluses dans toutes les formules, sont le parcours configurable — vous choisissez le périmètre, définissez une grille personnalisée, sélectionnez le modèle juge et évaluez au regard d'une version précise des instructions.
C'est ainsi que l'on mesure une modification de prompt : lancer une évaluation avant et après, puis comparer les scores, au lieu de deviner si le changement a aidé. L'évaluation porte sur les conversations passées, pas sur celles en cours — pour un contrôle en temps réel, utilisez les instructions de l'agent et les points de confirmation.
Questions fréquentes
Que vérifie réellement le juge ?
Si l'agent a suivi ses propres instructions sur chaque conversation passée — les bons outils, le bon routage, le ton et les limites que vous avez fixés — plus les contrôles personnalisés que vous ajoutez. Il renvoie un verdict Yes / Partially / No et un motif court par conversation.
Faut-il payer pour évaluer ses agents ?
Non. Auto-Eval est gratuit sur toutes les formules et note chaque exécution autonome, sans plafond de conversations. Les évaluations manuelles et configurables sont elles aussi incluses dans toutes les formules.
Termes liés
Configuration d'agents en langage courant
Dans Macha, vous configurez un agent en écrivant ses règles en langage courant dans son champ d'instructions — comment trier, quel ton adopter, quoi faire remonter, ce qui est interdit — plutôt qu'en codant une logique.
Crédits d'actions IA
Les crédits sont l'unité avec laquelle le tableau de bord de Macha mesure l'usage derrière votre quota mensuel de tickets.
Score d'assurance qualité (QA)
Un score d'assurance qualité (QA) mesure dans quelle mesure une interaction de support a respecté les standards de qualité de l'équipe, à partir d'une grille d'évaluation qui note des critères comme l'exactitude, le ton, le respect des politiques et la résolution..
Garde-fous IA
Les garde-fous IA sont les règles, contrôles et contraintes placés autour d'un système d'IA pour que son comportement reste sûr, dans le sujet et conforme à la politique de l'entreprise — en encadrant ce qu'il peut dire, faire et consulter..
Passez à l'action
Macha est une couche d'agents IA qui se pose sur le help desk que vous utilisez déjà, Zendesk, Freshdesk, Front, Intercom ou Gorgias.
Démarrer l'essai