Zero Data Retention no significa cero procesamiento: comprueba estos límites

Zero Data Retention (ZDR) significa que determinadas instrucciones y respuestas no se almacenan en reposo después de procesar una solicitud. No significa que el servicio pueda operar sin recibir y analizar ese contenido: la inferencia y los controles compatibles con la modalidad ocurren antes de aplicar la eliminación prometida.
La etiqueta tampoco garantiza por sí sola que los datos no se usen para entrenar, que ninguna persona pueda acceder a ellos o que desaparezcan todos los registros técnicos. Su alcance depende del contrato, la organización habilitada, el producto, el modelo, las funciones activas y las excepciones aplicables.
Qué promete realmente la retención cero
La pregunta decisiva no es si el proveedor «ve» los datos en algún momento, sino qué conserva cuando termina la operación. ZDR suele delimitar el almacenamiento posterior de contenido, mientras que el tratamiento necesario para producir la respuesta continúa formando parte del servicio.
Las garantías sobre conservación, entrenamiento, revisión humana y controles automatizados deben leerse por separado. La definición publicada por OpenAI afirma que, para clientes elegibles de la API, no conserva las instrucciones ni las respuestas después de procesar la solicitud, que los datos empresariales no se destinan a entrenamiento sin autorización expresa y que su personal no revisa el contenido; también declara una excepción para imágenes señaladas como posible material de abuso sexual infantil, que pueden conservarse para revisión manual y denuncia.
Ese ejemplo confirma que «no conservar», «no entrenar» y «no permitir revisión humana» son compromisos distintos, aunque un proveedor pueda ofrecerlos juntos. También demuestra que una excepción concreta puede limitar uno de ellos sin anular necesariamente los demás.
El procesamiento transitorio sigue existiendo

Una API necesita manejar la instrucción, los archivos adjuntos, el contexto y la salida mientras calcula la respuesta. En ese intervalo puede enrutar la petición, aplicar controles automatizados, ejecutar herramientas o mantener información en memoria; ZDR describe qué ocurre después, no la ausencia de esas operaciones.
Por eso conviene distinguir entre datos en tránsito, datos en memoria y datos en reposo. Una caché en memoria puede ser compatible con la definición de un proveedor y, aun así, importar para la evaluación de seguridad si tiene una duración determinada, se comparte o no entre proyectos, o no puede desactivarse.
La documentación de Google Cloud para Gemini Enterprise Agent Platform muestra hasta qué punto manda la configuración: contempla registros para supervisión de abuso, almacenamiento asociado a ciertas modalidades de grounding, escritura opcional de solicitudes y respuestas en BigQuery y una Interactions API cuyo parámetro de almacenamiento debe establecerse en falso para buscar retención cero.
La cobertura cambia por producto, función y organización

Una habilitación para la API no debe extrapolarse al chat web, al playground, a una aplicación de escritorio ni a una integración de terceros. Tampoco basta con comprobar el nombre comercial del modelo: una función con estado puede guardar archivos, trabajos, sesiones o datos de contenedores aunque el endpoint principal admita ZDR.
La matriz de retención de Anthropic define ZDR por organización y limita su aplicación a endpoints y funciones elegibles; no lo extiende automáticamente a Claude Console, las interfaces de Claude Teams y Claude Enterprise o las integraciones de terceros, y advierte que las funciones marcadas como no elegibles pueden ejecutarse sin que la API bloquee la solicitud, dejando esos datos bajo la política específica de la función.
La misma documentación diferencia además quién actúa como encargado del tratamiento: Anthropic ocupa ese papel en su API directa y en algunas plataformas, mientras que en Amazon Bedrock y Google Cloud la documentación del proveedor de nube determina los controles equivalentes. Por tanto, una promesa emitida por el desarrollador del modelo no cubre automáticamente toda la cadena técnica.
Cinco preguntas para revisar el contrato
- ¿Qué datos están cubiertos y cuáles quedan en reposo? Enumera instrucciones, respuestas, archivos, audio, imágenes, llamadas a herramientas y datos derivados. Separa ese contenido de metadatos operativos, identificadores, señales de seguridad, copias de respaldo y registros de facturación.
- ¿Qué artefactos técnicos pueden persistir? Solicita el contenido, la finalidad y el plazo de cualquier caché, esquema compilado, trabajo por lotes, archivo, estado de sesión, resultado de herramienta o contenedor. Una huella técnica limitada no equivale a una conversación completa, pero debe figurar en el análisis.
- ¿Qué producto, función, modelo y organización son elegibles? Registra los identificadores de organización, endpoints, versiones y modalidades aprobadas. Verifica aparte el procesamiento por lotes, la carga de archivos, el grounding, la ejecución de código, las sesiones, los conectores y cualquier función que mantenga estado.
- ¿Quién trata los datos en cada tramo? Identifica al proveedor del modelo, la plataforma de nube y los terceros conectados, junto con sus subencargados y ubicaciones de procesamiento. Cada parte necesita una base contractual propia; la cobertura no se hereda por integración.
- ¿Puede acceder una persona y bajo qué excepción? Distingue soporte, investigación de abuso, respuesta a incidentes y obligaciones legales. El acuerdo debe precisar finalidad, autorización, trazabilidad, datos accesibles y plazo de eliminación, no limitarse a indicar que el acceso está restringido.
La garantía debe coincidir con la arquitectura desplegada

La revisión termina en la configuración real, no en la página comercial. Una empresa puede separar organizaciones cuando cambie la modalidad, restringir modelos y funciones no elegibles, desactivar registros opcionales y documentar qué endpoints están autorizados para recibir información sensible.
ZDR reduce la persistencia dentro de un perímetro definido; no elimina el tratamiento ni sustituye los controles de privacidad, seguridad y cumplimiento. La conclusión válida debe formularse con el mismo nivel de precisión que el acuerdo: qué contenido no se conserva, desde qué momento, en qué producto y bajo qué excepciones.
Lee también:
Suscríbete a nuestro boletín
Reciba las últimas noticias sobre Web3, IA y criptomonedas directamente en su bandeja de entrada.