Macha
Kontinuierliche Auswertung

Bewerte jede Konversation, nicht nur die offensichtlichen.

Jede Konversation, die dein Agent bearbeitet, wird gegen die eigenen Anweisungen bewertet. Sieh genau, welche Regel befolgt wurde und welche gerutscht ist, in dem Moment, in dem sie rutscht.

Bewertung für conv_6a5a1206 · @refundAgent gerade eben
Anweisungen befolgt Ja

Der Agent hat das Ticket abgerufen, die Bestellhistorie der Kundin geprüft und das Rückerstattungsfenster abgeglichen, bevor er geantwortet hat.

Befolgt

Bestätige immer die Bestelldetails der Kundin, bevor du Richtlinien zitierst.

Er hat eine Rückerstattung angeboten, ohne den Rücksendegrund zu fragen, was die Anweisungen fordern.

Nicht befolgt

Bevor eine Rückerstattung genehmigt wird, frage die Kundin nach dem Grund der Rücksendung.

Ticket 8421 · Rückerstattungsantwort

Ja · Rückerstattungsrichtlinien-Check befolgt

2m

Ticket 8420 · Versandfrage

Teilweise · Sendungsverfolgungslink übersprungen

4m

Ticket 8419 · Rücksendeantrag

Ja · Rücksendegrund gefragt

7m

Ticket 8418 · Eskalation

Nein · Übergabeschritt verpasst

11m

Bewerte jede Konversation.

  • Ja / Teilweise / Nein

    Ein klares Urteil zu jeder Konversation mit schriftlicher Begründung.

  • Kostenlos in jedem Plan

    Die kontinuierliche Auswertung läuft auf jeder Konversation, ohne Zusatzkosten.

  • Gegen die richtige Version bewertet

    Bewertet gegen die Anweisungen, die live waren, als die Konversation stattfand, nicht was du seither bearbeitet hast.

Der Richter zitiert die exakte Regel.

  • Wortgetreue Zitate

    Wenn eine Regel zitiert wird, wird sie direkt aus deinen Anweisungen zitiert. Kein Umschreiben.

  • Befolgt, nicht befolgt, mehrdeutig

    Jede vom Richter referenzierte Regel ist getaggt, damit du auf einen Blick siehst, was gehalten und was gerutscht ist.

  • Lies es wie eine Review, nicht wie eine Note

    Regel + Begründung zusammen, damit ein Prüfer genau weiß, warum eine Entscheidung richtig oder falsch war.

Warum · @wismoAgent · Ticket 8421

Hat das Ticket gelesen, dann wie angewiesen direkt zur Shopify-Bestellabfrage.

Befolgt

Bei jeder Versandfrage schlage die Bestellung nach, bevor du antwortest.

Hat den Sendungsverfolgungslink und das Lieferfenster in derselben Nachricht geliefert.

Befolgt

Teile die Sendungsverfolgungs-URL und das voraussichtliche Lieferfenster in derselben Antwort.

Der eine Ausrutscher: Ticket-Status auf offen belassen, wenn ausstehend genauer gewesen wäre.

Nicht befolgt

Wenn die Kundin noch auf die Lieferung wartet, setze das Ticket vor der Antwort auf ausstehend.

Beobachte die Adherence im Zeitverlauf.

Jede bewertete Konversation trägt zu einem rollierenden Adherence-Score bei. Wenn er sich bewegt, weißt du genau, welche Regel angefangen hat zu rutschen.

Adherence-Score

86%

↑ 4% vs. letzte Woche
Ja 312
Teilweise 48
Nein 11

Letzte 30 Tage

@refundAgent
371 Konversationen bewertet
Jun 18Jun 25Jul 2Jul 9Today

Häufigst gebrochene Regel · 22 Konversationen

Bevor eine Rückerstattung genehmigt wird, frage die Kundin nach dem Grund für die Rücksendung.

Ist am 2. Juli abgerutscht. Ein Rollback des Modells auf dem Sample-Set hat sie innerhalb eines Tages wiederhergestellt.

Mit Claude Code gebaut

Erweitere es mit einem Coding-Agenten.

Kontinuierliche Auswertung ist ein Live-Signal, das du in alles Nachgelagerte einklinken kannst. Eine nächtliche Zusammenfassung. Ein Slack-Ping, wenn die Adherence fällt. Ein Wochenreport für dein Team.

Übergib deinen Macha-API-Key an Claude Code oder Codex, und er kann die Form deiner Auswertungen lesen und den Workflow bauen, den du im Kopf hast, ohne dass du die Verkabelung schreibst.

Mit Claude Code & Codex bauen
Slack

#support-qualität

Macha-Evals-Bot · 9:00 Uhr

Wöchentliche Adherence für @refundAgent

Ja

312

Teilweise

48

Nein

11

Häufigster Ausrutscher: „Rücksendegrund fragen“, 22 Konversationen.

Wie jede Bewertung landet

Konversation

@refundAgent

Hat get_ticket aufgerufen, Bestellhistorie geprüft, Antwort gesendet.

1

Konversation endet

Chat, autonom, Embed oder Übergabe. In dem Moment, in dem der Lauf endet, feuert die Bewertung im Hintergrund.

Y
Befolgt
N
Nicht befolgt
GPT-5-Richter
2

Der Richter bewertet

Der Richter liest die vollständige Trace und zitiert die exakte befolgte Regel und die exakte gerutschte Regel.

Rollierender Score
Häufigst gebrochene Regel
Drift-Alerts
3

Sieh die Adherence sich bewegen

Ein rollierender Score, die häufigst gebrochene Regel und Drift-Alerts. Alles abfragbar, alles exportierbar.

Fragen zur Auswertung.

Alles, was du zur Bewertung jeder Konversation deines Agenten wissen musst.

Jede Konversation, die dein Agent bearbeitet, wird von einem LLM-Richter gegen die eigenen Anweisungen bewertet. Der Richter wählt ein Urteil (Ja, Teilweise oder Nein), zitiert die exakten Regeln, die er als befolgt oder gerutscht gesehen hat, und speichert jedes Urteil als Datensatz, den du abfragen, gruppieren und exportieren kannst.
Nein. Kontinuierliche Auswertung ist in jedem Plan kostenlos enthalten, auch bei Tests. Die Urteile verbrauchen keine deiner Credits, du kannst sie also über jeden Agenten und jede Konversation aktiv lassen, ohne den Zähler zu beobachten.
Der Richter liest die vollständige Trace einer abgeschlossenen Konversation und beantwortet eine Frage: Hat der Agent seine eigenen Anweisungen befolgt? Er bewertet gegen die Anweisungen, die live waren, als die Konversation stattfand, zitiert die Regel wortgetreu und taggt jede zitierte Regel als befolgt, nicht befolgt oder mehrdeutig.
Der Richter und sein Schema sind fest, damit Ergebnisse über Agenten und Zeit hinweg vergleichbar bleiben. Was du anpasst, sind die Anweisungen des Agenten selbst. Jede Regel, die du schreibst, ist eine Regel, gegen die der Richter in künftigen Konversationen bewertet. Möchtest du eine Team- oder Workflow-Variante, kannst du auch eigene manuelle Studien parallel zur kontinuierlichen Auswertung starten.
Nein. Die Bewertung läuft nach Ende der Konversation, fire-and-forget, im Hintergrund. Dein Agent antwortet der Kundin, ohne auf den Richter zu warten, und das Urteil landet von selbst, sobald der Lauf beendet ist.
Zendesk
5,0 im Zendesk Marketplace

Von Support-Teams geliebt weltweit

Sieh, was Support-Teams über Macha AI sagen.

The application seems excellent to me! We are still testing, and we need support for some details and they were extremely efficient too!

Daniela Costa

Daniela Costa

Head of Support, Seabra

Macha has been a great addition to our support toolkit. It generates clear, well-organized responses that fit naturally into our workflow. One feature we particularly appreciate is its ability to automatically reply in the same language as the ticket.

Marius F

Marius F

Support Head, Zentana

We've been using Macha for a little while now and it's been really great addition so far! It's powerful, convenient, and makes getting work done a lot easier for our agents.

Alexander Wedén

Alexander Wedén

Head of Support

Support team is very helpful and responsive. Really enjoy how lightweight this is within Zendesk itself vs other more intrusive tools.

Cathleen Wright

Cathleen Wright

Zendesk Admin, Cortex IO

So far it's pretty good! Our queries are a little nuanced, so we can't always use it, but it's got enough utility for us. It can even incorporate our bilingual country with greetings in a second language.

Jae Oliver

Jae Oliver

Head of Support, Wise

Really enjoying using Macha, it has made a noticeable difference to our support team in a short amount of time. I really like the ticket summary feature, saves us a lot of time.

Harry Jackson

Harry Jackson

Head of Support, Crumb

Macha AI is a great addition to my workspace! It's powerful, convenient, and it really makes productivity so much easier for our agents!

Dave G

Dave G

Head of Support, Cyber Power Systems

Very impressed! AI integration for Zendesk has certainly come a long way and Macha seems to set the standard for now. This will for sure save lot of time in our support team.

Pauli Juel

Pauli Juel

Head of CS, Dokument24

Macha has been working great for us so far! The auto-responses are accurate and our resolution time has dropped significantly.

Lana T

Lana T

Zendesk Admin, Swotzy

Macha AI is a great addition. The knowledge base feature means our agents always have the right answers at their fingertips.

Mischa Wolf

Mischa Wolf

Head of Support, Topi

We're enjoying this integration so far. It's made our support team more efficient and our customers get faster responses.

Paula G

Paula G

Head of Customer Support, Xly Studio

The team enjoys using it. It saves considerable time on common questions and the integration options are excellent.

Kilian Leister

Kilian Leister

Support Head, Didriksons

Bereit, dein Team mit KI zu turbo-boosten?

Starte in Minuten. Verbinde deine Tools, konfiguriere deine Agenten und lass die KI den Rest erledigen.

500 Freikredite · ohne Zeitlimit, ohne Kreditkarte