2. Seguridad y gestión de datos
Política de almacenamiento
En Macha priorizamos la minimización de datos y solo guardamos la información esencial para el funcionamiento óptimo de la plataforma. Nuestra política mantiene un repositorio ligero manteniendo eficiencia y eficacia del servicio.
| Tipo de dato | Descripción | Procesador | Ubicación |
|---|
 Datos de productos Shopify (descripciones, variantes, SKUs) | Guardamos datos de productos Shopify como base de conocimiento para responder consultas de producto eficientemente. | |  Frankfurt, Alemania |
 Macros de Zendesk y artículos del centro de ayuda | Usamos datos de Zendesk, incluyendo macros y artículos, para que Macha AI ofrezca soluciones a medida a agentes y clientes. | |  Frankfurt, Alemania |
 Tickets pasados de Zendesk | Los datos de tickets de Zendesk se usan para dar a los agentes contexto sobre tickets relevantes según la consulta entrante. | |  Frankfurt, Alemania |
Cifrado de datos sensibles
Priorizamos la seguridad y protección de datos sensibles, incluso cuando su almacenamiento se reduce al mínimo. Para los datos sensibles que sí guardamos, aplicamos cifrado estricto para protegerlos frente a accesos no autorizados.
- Macha aplica cifrado a nivel de campo a todos los datos sensibles de tickets y agentes.
- Usamos cifrado AES-256-GCM, un estándar moderno que proporciona confidencialidad e integridad. Cada campo se cifra individualmente y todas las claves se derivan y gestionan con derivación con salt (scrypt).
- La comunicación entre sistemas, incluidos navegadores, Zendesk, Supabase, MongoDB y OpenAI, se protege con TLS 1.2+ o superior.
- La información personal identificable (PII), como correos de agentes y contexto de cliente, se redacta cuando es posible y se cifra a nivel de campo cuando su retención es necesaria.
Protección de datos en IA y anonimización de PII
Las capacidades de IA de Macha se basan en modelos de lenguaje grandes (LLMs), principalmente OpenAI, accedidos vía su API. Dado que los tickets y conversaciones pueden contener datos personales, Macha te da control directo sobre lo que llega al proveedor del modelo.
Anonimizar PII antes de que llegue a la IA
Macha incluye un control opcional de anonimización de PII (disponible en planes Pro). Cuando está activado, los identificadores personales estructurados se sustituyen por tokens no identificativos antes de que cualquier petición salga de Macha al proveedor del LLM. El modelo razona sobre el texto tokenizado y nunca recibe los valores reales de esos campos.
Las siguientes categorías se detectan y tokenizan automáticamente:
- Correos electrónicos
- Teléfonos
- Números de tarjeta
- Identificadores nacionales (por ejemplo, SSN de EE. UU. y equivalentes)
- Direcciones IP
- URLs
Cómo funciona, de punta a punta:
- Detección y tokenización. Cuando un ticket o mensaje se prepara para la IA, Macha escanea los tipos anteriores y sustituye cada valor por un token reversible (por ejemplo, un correo pasa a ser
[EMAIL_1]). La correspondencia token/valor real se conserva solo dentro de Macha y nunca se transmite. - Solo se envían tokens. Al proveedor del LLM se le transmite el texto tokenizado, no el PII original, sobre TLS 1.2+.
- Las tools reciben valores reales justo a tiempo. Cuando la IA necesita actuar (por ejemplo, buscar un pedido o actualizar un registro), el token se sustituye por su valor real justo en el momento de ejecutar la tool. La funcionalidad se preserva; el valor real se usa solo dentro de tus sistemas conectados, no se envía al modelo.
- Restauración en el retorno. Cuando llega la respuesta del modelo, Macha vuelve a sustituir los valores reales para que agentes y clientes vean la información correcta y completa.
Alcance y limitaciones actuales, dichas claramente. Esta versión detecta identificadores estructurados y bien formateados mediante coincidencia por patrones. No detecta automáticamente nombres personales u otros identificadores en texto libre escritos en prosa, porque no siguen un formato fijo reconocible por máquina. Lo documentamos abiertamente para que el control pueda evaluarse con precisión. La anonimización de PII es una capa de un modelo de defensa en profundidad, aplicada junto a residencia de datos solo en la UE, cifrado AES-256-GCM a nivel de campo, ventanas de retención cortas y protecciones contractuales (DPA), y no debe usarse como salvaguarda única.
Tratamiento por parte del proveedor. Macha accede a OpenAI por su API. Los datos enviados por la API de OpenAI no se usan para entrenar sus modelos. Combinado con el control anterior de anonimización, los identificadores estructurados listados se tokenizan antes de enviarse y el resto del contenido es procesado por la API sin retenerse para entrenamiento del modelo.
Datos que no almacenamos
Mantenemos una política estricta de minimización de datos, garantizando que la información sensible no se almacena ni retiene innecesariamente. Nos comprometemos a proteger la privacidad y confidencialidad de nuestros clientes y sus clientes finales absteniéndonos de guardar las siguientes categorías:
- Contraseñas: Macha no guarda contraseñas en ningún formato. Usamos métodos seguros como OTP por correo para verificar identidades sin retener contraseñas.
- Datos financieros de los clientes finales: los datos financieros de los clientes finales (tarjetas, cuentas bancarias, historial de transacciones) no se almacenan en nuestros sistemas. No accedemos ni retenemos datos financieros de transacciones realizadas por los clientes finales.
- IDs (documentos de identificación): Macha no guarda documentos de identificación (DNI, pasaportes, carnets) de clientes ni de sus clientes finales.
- Pedidos de Shopify: no retenemos información sobre pedidos de Shopify (detalles, direcciones de envío o información de pago asociada a pedidos procesados por Shopify).
Retención de datos
- Macha implementa políticas de retención automatizadas para que la información sensible no se conserve más de lo necesario.
- Por defecto, el contenido de tickets generado por IA, respuestas de agente, traducciones y metadatos asociados se retienen 45 días desde la creación.
- Se aplica mediante indexación TTL automática en nuestras bases de datos, que borra de forma segura e irreversible los datos vencidos.
- Los clientes en planes enterprise pueden solicitar políticas personalizadas a nivel organizativo (por ejemplo, 30, 180 o 365 días).
- Los datos anteriores a la ventana configurada se purgan automáticamente y no pueden recuperarse.
- La analítica de onboarding y uso del widget se retiene un máximo de 12 meses para mejora del producto, salvo eliminación anticipada.
Eliminación de datos
En Macha priorizamos un manejo seguro y responsable de los datos, asegurando que las eliminaciones se ejecuten con eficiencia y conforme a las preferencias del usuario. Nuestra política facilita la eliminación oportuna de cuentas desactivadas ofreciendo flexibilidad.
- Desactivación e inicio: al desactivar la cuenta iniciamos el proceso de eliminación. Tras 60 días entra en estado "Pendiente de eliminación".
- Eliminación permanente: 15 días después los datos se eliminan definitivamente de nuestros sistemas.
- Eliminación acelerada: a petición del cliente podemos acelerar la eliminación en cuestión de horas.
Derechos del interesado (RGPD)
Conforme al RGPD, Macha soporta los derechos del interesado. Los clientes (como responsables del tratamiento) pueden solicitar:
- Acceso a los datos personales que Macha guarda
- Corrección de información inexacta
- Eliminación de datos personales (derecho al olvido)
- Exportación de datos en formato portátil (JSON o CSV)
Macha ha implementado herramientas internas y APIs para consultar y gestionar de forma segura los datos por ID de ticket, ID de agente o correo. Esto permite acciones precisas y auditables ante solicitudes de acceso o borrado bajo el RGPD.
Las solicitudes se inician mediante el equipo de soporte y se resuelven en 30 días salvo que la ley requiera otro plazo.