Zero data retention
Término 311 de 314 · Tecnología
En una frase
Zero data retention es una garantía contractual y técnica por la cual un proveedor de IA no almacena ni retiene los datos que enviás en tus prompts: se procesan para generar la respuesta y se descartan, sin guardarse en logs ni usarse para entrenar modelos.
Zero data retention (retención cero de datos) es un compromiso por el cual un proveedor de modelos de IA garantiza que no almacena, no registra ni retiene la información que vos le enviás. Tu prompt y la respuesta del modelo se procesan en memoria el tiempo justo para resolver la consulta y después se descartan: no quedan en logs, no se guardan en una base de datos y, sobre todo, no se usan para entrenar futuros modelos.
Es una de las garantías centrales cuando una empresa lleva datos sensibles (clientes, contratos, salud, finanzas) a un modelo de lenguaje. Sin retención cero, lo que escribís podría quedar guardado en la infraestructura del proveedor, exponiéndote a fugas, accesos indebidos o usos secundarios no autorizados. Por eso forma parte del estándar de seguridad y confidencialidad que Vantegrate aplica al implementar IA, descrito en Seguridad.
En la práctica, zero data retention se materializa de dos formas que conviene distinguir: una garantía contractual (lo que el proveedor se obliga por escrito a no hacer) y un control técnico (cómo la arquitectura impide efectivamente que los datos persistan). Una implementación seria combina las dos.
Por qué importa para una empresa
Cuando una empresa empieza a usar IA generativa o agentes de IA sobre sus procesos, los prompts dejan de ser preguntas inocentes: pasan a contener datos reales del negocio. Un agente de cobranza ve montos, números de factura y nombres de clientes; un asistente de ventas ve oportunidades y precios; un copiloto legal ve cláusulas de contratos. Si el proveedor del modelo guarda todo eso, la empresa pierde el control sobre dónde vive su información más sensible y queda expuesta a un riesgo regulatorio y reputacional grande.
Zero data retention corta ese riesgo en la raíz: garantiza que esos datos no sobreviven a la consulta. No quedan en un repositorio del proveedor, no son legibles por su personal y no terminan, vía entrenamiento, mejorando un modelo que mañana usa tu competidor. Para sectores regulados en Argentina y la región (servicios financieros, salud, farmacéutica) es muchas veces la condición sin la cual el proyecto de IA directamente no arranca.
Cómo funciona en la práctica
La retención cero se sostiene sobre varias capas que actúan juntas:
- Procesamiento efímero: el prompt se carga en memoria, el modelo genera la respuesta y todo se libera. No hay escritura a disco persistente del contenido.
- Sin logging de contenido: se pueden registrar metadatos operativos (cuántas consultas, latencia, errores) pero no el texto del prompt ni de la respuesta.
- Exclusión de entrenamiento: los datos enviados quedan fuera de cualquier dataset que se use para reentrenar o afinar el modelo (lo opuesto del fine-tuning con tus datos).
- Garantía contractual y de cumplimiento: queda escrito en el contrato o términos del servicio, idealmente respaldado por certificaciones y auditorías independientes.
En el ecosistema Salesforce, este principio es exactamente lo que provee el Einstein Trust Layer: una capa que se interpone entre los datos de la empresa y el modelo, garantizando retención cero ante el proveedor del LLM, además de enmascarar datos sensibles y registrar auditoría. Es la diferencia entre llamar a una API pública con tus datos crudos y operar dentro de un perímetro de confianza diseñado para empresas.
Un ejemplo concreto
Pensá en una financiera argentina que quiere un agente que responda consultas de scoring crediticio. Cada consulta incluye CUIT, ingresos declarados y historial del solicitante: datos protegidos por la normativa de datos personales. Sin retención cero, esa información podría quedar almacenada en servidores del proveedor del modelo, fuera del país y fuera del control de la empresa. Con zero data retention, la consulta se procesa, devuelve el resultado y desaparece: el dato nunca persistió afuera, y la empresa puede demostrarle al auditor que su información sensible no se almacenó ni se reutilizó.
En qué se diferencia de conceptos parecidos
Es fácil confundir retención cero con otras garantías de privacidad. La tabla aclara las fronteras:
| Concepto | Qué garantiza | Qué NO garantiza por sí solo |
|---|---|---|
| Zero data retention | El proveedor no almacena ni retiene tu prompt/respuesta | Que el dato no salga de tu país (eso es residencia) |
| No usar datos para entrenamiento | Tus datos no afinan el modelo | Que no se guarden en logs operativos |
| Residencia de datos | El dato se procesa en una región/país específico | Que no se retenga; podría guardarse localmente |
| Cifrado en tránsito | El dato viaja protegido por la red | Qué hace el proveedor una vez que lo recibe |
La conclusión práctica: zero data retention responde a la pregunta qué pasa con mi dato después de que el modelo lo procesa. Una arquitectura segura completa la combina con residencia de datos, cifrado y control de accesos, no la usa como única defensa.
Errores comunes al evaluarla
- Asumir que retención cero es el default: muchas APIs públicas de IA, por el contrario, retienen datos por días para abuso/seguridad salvo que actives un modo o plan específico. Hay que verificarlo, no suponerlo.
- Confundirla con anonimización: retención cero no anonimiza nada; significa que el dato (anonimizado o no) no se guarda. Son controles complementarios.
- Quedarse solo con la promesa contractual: una cláusula sin un control técnico verificable y, mejor aún, auditorías de terceros, es una garantía débil.
- Ignorar la cadena completa: si tu propia integración o un intermediario loguea los prompts, la retención cero del proveedor del modelo no te sirve de mucho. La garantía tiene que cubrir todo el recorrido del dato.
Preguntas frecuentes sobre Zero data retention
¿Qué es zero data retention?
¿Qué es zero data retention?
Zero data retention (retención cero de datos) es la garantía de que un proveedor de IA no almacena ni retiene los datos que enviás en tus prompts. La información se procesa para generar la respuesta y se descarta de inmediato: no queda en logs, no se guarda en bases de datos y no se usa para entrenar modelos. Es un control clave para llevar datos sensibles de la empresa a un modelo de lenguaje de forma segura.
¿Zero data retention significa que mis datos no se usan para entrenar la IA?
¿Zero data retention significa que mis datos no se usan para entrenar la IA?
Sí, es uno de sus efectos centrales: bajo retención cero tus prompts y respuestas quedan excluidos de cualquier dataset de entrenamiento o afinamiento del modelo. Pero conviene leer la garantía completa, porque no usar los datos para entrenamiento y no almacenarlos en logs operativos son dos compromisos distintos. Una garantía sólida cubre ambos por escrito y con respaldo técnico.
¿En qué se diferencia zero data retention de la residencia de datos?
¿En qué se diferencia zero data retention de la residencia de datos?
Responden a preguntas distintas. La residencia de datos define en qué país o región se procesa y se guarda tu información. La retención cero define qué pasa con esa información después de procesarla: garantiza que no se almacena ni se retiene. Una arquitectura segura combina las dos, porque un dato podría procesarse en tu país y aun así quedar guardado, o procesarse afuera pero no retenerse.
¿Cómo se garantiza zero data retention en Salesforce?
¿Cómo se garantiza zero data retention en Salesforce?
En el ecosistema Salesforce, la retención cero ante el proveedor del modelo la provee el Einstein Trust Layer, una capa que se interpone entre los datos de la empresa y el LLM. Además de garantizar que el modelo no retiene tus datos, enmascara información sensible antes de enviarla, aplica filtros de seguridad y registra auditoría. Es lo que permite usar IA generativa sobre datos corporativos sin exponerlos al proveedor del modelo.
¿Las APIs públicas de IA ofrecen zero data retention por defecto?
¿Las APIs públicas de IA ofrecen zero data retention por defecto?
No siempre, y ese es un error común. Muchas APIs públicas retienen los datos durante algunos días por motivos de seguridad y abuso, salvo que contrates un plan empresarial o actives un modo específico que habilite la retención cero. Por eso nunca conviene asumirlo: hay que verificarlo en los términos del servicio antes de enviar datos sensibles del negocio.
Checklist del CISO
Las 19 preguntas para evaluar a cualquier proveedor de IA, incluido Vantegrate.
Abrir la herramientaTus datos, con esto resuelto desde el día uno
Cada implementación corre sobre la infraestructura certificada de Salesforce y AWS, con los permisos y la trazabilidad definidos antes de mover un dato. Te contamos qué controles aplican a tu caso.
El glosario completo (más de 290 definiciones de IA, Salesforce y datos) en un PDF con hipervínculos.
Términos relacionados
- Einstein Trust LayerEl Einstein Trust Layer es la capa de seguridad y confianza de Salesforce que protege la IA generativa: enmascara datos sensibles, no entrena los modelos con tu información y registra cada interacción para auditoría.
- IA generativaLa IA generativa es una rama de la inteligencia artificial que crea contenido nuevo (texto, imágenes, código, audio) a partir de patrones aprendidos de grandes volúmenes de datos, en lugar de solo clasificar o predecir sobre datos existentes.
- GuardrailsLos guardrails son las barreras de seguridad que limitan qué puede decir o hacer un sistema de IA: definen temas prohibidos, acciones bloqueadas y respuestas filtradas, para que el modelo opere dentro de límites controlados y predecibles en producción.
- GroundingEl grounding es la técnica que ancla las respuestas de un modelo de IA en datos reales y verificables de tu empresa (CRM, documentos, bases de datos) en vez de dejar que invente, reduciendo así las alucinaciones y aumentando la confiabilidad.
- Perfil y conjunto de permisosEl perfil y el conjunto de permisos son los dos mecanismos de Salesforce que definen qué puede ver y hacer un usuario. El perfil es la base obligatoria (uno por usuario) y los conjuntos de permisos suman accesos extra sin duplicar perfiles.
- Prompt injectionEl prompt injection es un ataque a sistemas de IA donde un atacante esconde instrucciones maliciosas en el texto que el modelo procesa, para que ignore sus reglas originales y ejecute acciones no autorizadas, filtre datos o genere respuestas dañinas.
Seguridad
Cómo se protegen tus datos en cada implementación, sobre la infraestructura certificada de Salesforce y AWS.
Así lo resolvemos en cada implementaciónSeguí leyendo en Pulse
Por qué los Proyectos de Salesforce / Oracle fracasan por las Personas y no por la Plataforma
Descubrí por qué los proyectos de Salesforce u Oracle suelen fracasar por factores humanos, como requerimientos poco claros o falta de comunicación, y no por la tecnología en sí. La clave está en la g
Seguridad en Salesforce: por qué la plataforma sube la vara (y cómo no quedar afuera de su propia Org)
Salesforce sube la vara de seguridad: MFA, passkeys y verificación de identidad. Te contamos qué cambia y cómo preparar a tu equipo sin sobresaltos.
Agentforce DX y el MFA resistente a phishing: los dos cambios de Salesforce que tenés que dominar
Salesforce introduce Agentforce DX para gestionar agentes de IA como código y exige MFA resistente a phishing para usuarios privilegiados a partir de julio de 2026. Conoce los detalles de estos cambio
Ahora que sabés qué es, mirá cómo se resuelve
Cinco productos de IA que trabajan sobre el CRM que ya usás. No reemplazan tu sistema: le agregan la capa que hoy hacés a mano.


