Prueba un agente con tickets reales
sin tocarlos.
Una simulación pasa tu agente por tus tickets reales de producción y te muestra exactamente qué habría hecho en cada uno, sin enviar una sola respuesta ni ejecutar una sola escritura.
#20831 · ¿Dónde está mi pedido?
Antonio R. · abierto · 2 respuestas
Hice el pedido la semana pasada y todavía no he recibido nada. Número de pedido 20831. ¿Pueden ayudarme?
La respuesta que habría enviado
«Hola Antonio: tu pedido salió el 12 de julio y hoy está en reparto, llegará antes de las 18:00. Si no llega para entonces, responde por aquí y reclamo al transportista de inmediato.»
Agente de reembolsos
@refund · GPT-5
Nunca ejecutado sobre un ticket real
Ya construiste el agente. Ahora toca confiarle un cliente real.
Ahí es donde todo el mundo se frena. Las instrucciones se leen bien, se portó bien en el panel de pruebas y los tickets de muestra fueron los que se te ocurrieron. Nada de eso te dice cómo maneja los tickets desordenados, mal explicados y con tres temas a la vez que llegan de verdad.
Así que el agente se queda apagado, o se activa y alguien vigila la cola con el dedo sobre el botón de pausa. Las simulaciones existen para eliminar esa disyuntiva: ejecútalo primero sobre lo real y lee qué habría hecho antes de que nada llegue a nadie.
Cómo se mantiene seguro
Las lecturas son reales. Las escrituras se capturan, nunca se envían.
Una ejecución en seco solo sirve si el contexto es genuino, así que el agente consulta tus datos de verdad. La diferencia está en qué ocurre cuando intenta actuar: cada escritura se intercepta y se responde con un resultado plausible, de modo que el agente sigue razonando mientras nada llega a destino.
Las herramientas de lectura se ejecutan de verdad
Datos en vivo · sin efectos secundarios
El agente ve exactamente lo que vería en producción, que es la única forma de que la ejecución diga algo cierto.
Las herramientas de escritura se interceptan
Cero efectos secundarios
Respuestas, cambios de estado y asignaciones se capturan para que puedas leerlas y luego se descartan. El agente cree que la escritura funcionó y sigue razonando; nada sale de tu espacio de trabajo.
Es decir: puedes apuntar un agente recién creado a la cola real de la semana pasada desde el primer día, y lo peor que puede pasar es que aprendas algo.
La parte que lo hace honesto
Cada ticket se reproduce como si acabara de entrar.
Un ticket resuelto ya contiene la respuesta, así que reproducirlo entero no probaría nada. Macha lo reduce al primer mensaje del cliente y le pasa eso al agente, con el asunto, las etiquetas y la prioridad originales, y nada más.
Lo que ve el agente
Lo que se elimina
Así la ejecución te dice cómo maneja tu agente un ticket recién llegado, no lo bien que sabe leer la respuesta de otra persona.
Cuándo vale realmente la pena.
Siempre que la respuesta sincera a «¿esto funcionará?» sea «probablemente, pero prefiero no descubrirlo delante de un cliente».
Un agente nuevo, antes de que entre en producción
Ya escribiste las instrucciones y conectaste las herramientas. Ejecútalo sobre unos cientos de tickets reales y lee los fallos antes de activar el disparador.
La mezcla real de tickets de un cliente nuevo
Demuestra que el agente resuelve su cola real, no ejemplos sintéticos, sin tocar ni una de sus conversaciones en vivo.
Una conexión de herramientas que no tienes clara
Cada llamada que hace el agente aparece con sus argumentos y la respuesta que recibió. Las herramientas que faltan y los parámetros erróneos salen aquí, no en producción.
Lo que recibes.
El mismo juez que califica tus conversaciones en vivo califica cada una simulada, así que las cifras son directamente comparables con la puntuación de cumplimiento real del agente.
Cumplimiento
92 %
Registros
120
Escrituras capturadas
206
Créditos
480
#20831 · ¿Dónde está mi pedido?
Consultó el pedido, dio la fecha de seguimiento y ofreció reclamar al transportista. Con buen criterio, no ofreció reembolso.
#20847 · Talla equivocada enviada
Confirmó el artículo, inició una devolución y habría etiquetado el ticket y dejado en pendiente.
#20852 · Falló el código de descuento
Respondió correctamente, pero se saltó la instrucción de comprobar si el código ya se había canjeado.
Cuatro funciones que suenan parecido. No lo son.
Una simulación ejecuta tu agente sobre registros reales y muestra qué habría hecho. Nada llega al cliente.
Studies — Análisis con IA
Ejecuta un análisis sobre miles de registros y recibe una tabla estructurada.
Evaluación de agentes
Califica las conversaciones que ya ocurrieron según las propias instrucciones del agente.
AI Knowledge Builder
Convierte tickets resueltos en una base de conocimiento que tus agentes pueden consultar.
Preguntas sobre las simulaciones.
Respuestas breves. Si falta algo, pregúntanos: te lo diremos sin rodeos.
¿Listo para potenciar a tu equipo con IA?
Empieza en minutos. Conecta tus herramientas, configura tus agentes y deja que la IA se encargue del resto.
$50 en créditos gratis · sin límite de tiempo, sin tarjeta de crédito
Intercom
Shopify
Stripe
Slack
Notion
Google Workspace
Confluence