Decir "No entrenamos con tus datos" es gratis - 12 preguntas para comprobarlo

No entrenamiento con tus datos significa que un proveedor procesa tu contenido para entregarte el resultado que pediste y nunca lo retroalimenta en el entrenamiento, ajuste fino, evaluación o benchmarking de un modelo de machine learning. Tus documentos son un insumo para el servicio, no materia prima para el producto.

Esa oración no le cuesta nada escribirla a un proveedor, que es la razón por la que tu revisor de seguridad dejó de aceptarla. A continuación, se encuentran las 12 preguntas para ponerla a prueba y las respuestas de Parseur a las mismas, incluidas aquellas en las que la respuesta honesta es "pregúntanos y exígenos que lo pongamos por escrito".

Puntos Clave

  • No entrenamiento con tus datos significa que tu contenido se procesa, nunca se recicla en un modelo.
  • Cualquier proveedor puede decirlo, por lo que las revisiones de seguridad han pasado a las partes que puedes comprobar: subprocesadores nombrados, retención cotizada en días y la excepción de datos anonimizados cerrada.
  • Parseur nunca reutiliza los datos de los clientes para entrenar sus modelos de IA y nunca los vende, está alojado en la UE, es nativo del GDPR y te permite establecer la ventana de retención de documentos desde un día hasta ilimitado.
  • SOC 2 Tipo II e HIPAA están en progreso y en camino para 2026, lo que significa que no están certificados hoy. Parseur tampoco es un proveedor de retención cero de datos, y esta página explica por qué ningún analizador de documentos que realmente querrías utilizar puede serlo.

Por qué "Nunca entrenamos con tus datos" dejó de significar algo

Todos los proveedores lo dicen ahora. Lo cual es exactamente el problema.

Un revisor que lee "nunca entrenamos con tus datos" en una página de marketing no ha aprendido nada que pueda incluir en un registro de riesgos. La oración no tiene alcance, no nombra subprocesadores, no cita números de retención y no lleva la firma de nadie.

La brecha entre esa oración y el contrato resulta ser amplia. El Informe de Tendencias de Privacidad e IA de 2026 de DataGrail, que analizó 2.400 proveedores populares de software empresarial, encontró que el 63,6% de los proveedores que anuncian capacidades de IA no revelan un subprocesador de IA de terceros en ninguna parte de su documentación legal.

Unos pocos de esos proveedores genuinamente no tienen ningún subprocesador que revelar. El resto te está pidiendo que aceptes una cadena de suministro no identificada basada en la confianza, y desde el exterior no puedes distinguir ambos grupos. Ese es todo el trabajo de las siguientes preguntas.

Así que la pregunta útil ya no es si un proveedor tiene una política de no entrenamiento. Es qué sobrevive cuando les pides que lo dejen por escrito.

Procesamiento versus Entrenamiento, y por qué solo uno es reversible

Dos cosas pueden ocurrirle a un documento que subes, y la diferencia radica en si queda algo atrás cuando termina el trabajo.

  • Procesamiento: tus datos se utilizan en tiempo real para completar una tarea, como extraer las líneas de detalle de la factura de un proveedor. Cuando la tarea termina, los datos no vuelven a entrar al sistema para un aprendizaje futuro.
  • Entrenamiento: tus datos alimentan un modelo para mejorarlo, de modo que tus insumos se convierten en parte de lo que el modelo sabe. No hay forma de deshacerlo. Recuperar tu contenido significa reentrenar el modelo, y nadie tiene presupuesto para eso.

Desdibujar esa línea creó tres problemas que sobrevivieron a la confusión. Los documentos confidenciales podían ser reconstruidos a partir de un modelo que los había memorizado. La propiedad se volvió turbia, porque un modelo entrenado con tus contratos ha absorbido tu propiedad intelectual. Y las industrias reguladas perdieron la capacidad de responder a la pregunta de auditoría más básica que existe, que es a dónde fueron realmente los datos del cliente.

Una política de no entrenamiento elimina la ambigüedad. Tus datos se procesan para la tarea y luego se detiene.

Retención Cero de Datos, y por qué Parseur no la afirma

La retención cero de datos (ZDR) significa que un proveedor procesa tu solicitud en la memoria y no escribe nada en el disco. Ni entradas almacenadas, ni salidas almacenadas, ni registros de contenido. Es la postura más estricta disponible, y los equipos de adquisiciones la piden cada vez más por su nombre en lugar de preguntar sobre el entrenamiento.

También se sobrevalora constantemente, por lo que vale la pena saber qué tiende a omitir la ZDR.

  • Los metadatos de facturación sobreviven. Las marcas de tiempo, los recuentos de tokens y la latencia tienen que anotarse en alguna parte, o nadie podrá facturarte.
  • El monitoreo de abuso y seguridad puede quedar completamente fuera del acuerdo, lo cual es una vía de revisión humana de la que nunca te informaron.
  • No todos los endpoints son elegibles para ZDR. Llamar a uno que no lo es, es una decisión silenciosa de salirte de tu propio acuerdo, generalmente tomada por un ingeniero que nunca lo leyó.

Aquí está la parte que omiten la mayoría de las páginas de proveedores. Parseur no es un producto de retención cero de datos, y ningún analizador de documentos que te permita volver a ejecutar una extracción o revisar los resultados del mes pasado honestamente puede serlo. Reprocesar un documento requiere que el documento todavía esté allí. Lo que Parseur te da en su lugar es una ventana de retención que tú controlas, desde un día hasta ilimitado dependiendo de tu plan, con eliminación automática en el momento en que se cierra la ventana.

Si un proveedor te ofrece un historial de documentos completo y retención cero de datos al mismo tiempo, pregunta cuál de los dos te van a quitar.

Las 12 preguntas que debes hacerle a un proveedor de extracción de documentos sobre el entrenamiento de IA y la retención

Infografía tipo checklist de las preguntas que hacerle a un proveedor de extracción de documentos sobre el entrenamiento de IA, subprocesadores y retención de datos
Las preguntas para enviarle a tu proveedor

Copia esto en tu cuestionario de proveedores. Cada una tiene una respuesta corta si el proveedor ha hecho el trabajo, y una larga pausa si no lo ha hecho.

  1. ¿Utilizan nuestros documentos subidos, campos extraídos, metadatos, correcciones o resultados para entrenar, ajustar (fine-tune), evaluar o hacer benchmarking a cualquier modelo?
  2. ¿Esa respuesta también cubre versiones anonimizadas, desidentificadas, agregadas o derivadas de nuestros datos?
  3. ¿Qué subprocesadores externos de IA, OCR o nube reciben nuestros documentos? Nombra a cada uno y di dónde se ejecuta.
  4. ¿Están esos subprocesadores contractualmente impedidos de utilizar nuestros datos para entrenamiento o mejora del servicio?
  5. ¿Cuánto tiempo se conserva cada tipo de dato: documentos originales, campos extraídos, registros de procesamiento, registros de errores, cachés y copias de seguridad?
  6. ¿Podemos configurar la ventana de retención nosotros mismos y cuál es la más corta que ofrecen?
  7. ¿Podemos eliminar datos a pedido y cuál es el SLA de eliminación por escrito?
  8. ¿La eliminación llega a las copias de seguridad y cuánto tiempo pasa hasta que se sobrescriben?
  9. ¿Pueden sus empleados o contratistas ver nuestros documentos, bajo qué circunstancias, y ese acceso queda registrado?
  10. ¿Alguna vez se copian los datos de los clientes en entornos de desarrollo, pruebas, QA o demostración?
  11. ¿Dónde se almacenan y procesan nuestros datos, y pueden alguna vez salir de esa región?
  12. ¿Estos compromisos estarán en el DPA o MSA firmado, y prevalecerán sobre sus términos en línea si los dos alguna vez no concuerdan?

Un proveedor que responda a las doce en un solo párrafo fluido está adivinando. Un proveedor que responda con nombres, números y una referencia a cláusulas, ya se lo han preguntado antes.

Las respuestas de Parseur, incluida la incómoda

Infografía que muestra cómo Parseur procesa los documentos de los clientes sin utilizarlos para entrenar modelos de IA
Cómo implementa Parseur esta política

Parseur es un analizador de documentos. Tú le envías facturas de proveedores, él te devuelve campos estructurados, y no entrena con los datos de los clientes. Esto es lo que ocurre con esas facturas, mapeado a las preguntas anteriores.

Pregunta La respuesta de Parseur
1. Entrenamiento de modelos Los datos de los clientes nunca se reutilizan para entrenar los modelos de IA de Parseur y nunca se venden. Cada extracción se ejecuta para producir tu resultado y nada más.
5 y 6. Retención El período de retención de documentos es configurable desde un día hasta ilimitado, según tu plan. Los documentos se eliminan automáticamente cuando se cierra la ventana, y a pedido cuando lo solicites.
11. Ubicación Alojado en la UE y nativo del GDPR, manteniendo la residencia de datos en la UE. El centro de datos de alojamiento tiene certificación ISO 27001, que es el certificado del centro de datos y no una certificación de Parseur.
12. Roles y papeleo Tú eres el controlador de los datos, Parseur es el procesador de los datos, y el Acuerdo de Procesamiento de Datos rige lo que eso permite.
Normativas Alineado con el GDPR de la UE, GDPR del Reino Unido, CCPA y CPRA de California, y PDPA de Singapur. Detalle en Privacidad y GDPR en Parseur.
Certificaciones Los programas SOC 2 Tipo II e HIPAA están en progreso y en camino para 2026. Parseur no está certificado contra ninguno de los dos en la actualidad.
Controles de seguridad Cifrado en tránsito y en reposo, permisos basados en roles y registros de auditoría (audit trails), además de pruebas de seguridad regulares por terceros.
2, 3, 4, 7, 8, 9 y 10 No se responden en esta página. Pregúntanos y pondremos la respuesta en el acuerdo firmado en lugar de en una página web que podríamos editar silenciosamente el próximo trimestre.

Escribir "en progreso" donde un logotipo se vería mejor cuesta un poco de arrogancia y gana mucha credibilidad. Un revisor que detecta una certificación exagerada deja de creer en las otras once respuestas, y tiene razón en hacerlo.

Dos de esas filas las puedes verificar antes de hablar con nadie. El Acuerdo de Procesamiento de Datos es un documento que puedes leer íntegramente antes de firmar, y la ventana de retención es un ajuste que puedes ver en tu propia cuenta en lugar de una promesa sobre una.

Crea tu cuenta gratuita
Ahorra tiempo y esfuerzo con Parseur. Automatiza tus documentos.

A qué se comprometen realmente OpenAI, Microsoft, Anthropic, AWS y Google

Los compradores empresariales arrastraron a todo el mercado hacia garantías explícitas, y la forma de una buena respuesta ya está establecida.

  • OpenAI divide por producto. Los datos de los consumidores de ChatGPT se pueden usar para mejorar los modelos, mientras que los niveles empresariales y de API se excluyen de forma predeterminada con controles de exclusión documentados.
  • Microsoft se apoya en el aislamiento. Copilot para Microsoft 365 y Azure OpenAI excluyen el contenido del cliente del entrenamiento del modelo fundamental y publican una ventana de retención predeterminada para los datos de procesamiento transitorios.
  • Anthropic se compromete públicamente a no entrenar con datos empresariales.
  • Google Cloud y AWS publican exclusiones de entrenamiento para Document AI y Textract en sus términos de gobernanza de datos, aunque AWS requiere que apliques una política explícita de exclusión (opt-out) a nivel de organización en lugar de adoptarla por defecto. Excluido por defecto y excluido una vez que alguien recuerda hacer clic no es el mismo compromiso.

Nota lo que tienen en común. La respuesta vive en un documento de gobernanza en lugar de en una publicación de blog, y llega con una opción predeterminada con nombre. Ese es el listón, y es el listón que esta página intenta superar.

Por qué esta pregunta ahora bloquea compras

Los compradores no preguntan por curiosidad. Una encuesta de 2025 de The Futurum Group encontró que el 52% de las organizaciones prioriza la experiencia técnica del proveedor de IA, con el manejo de datos y los controles de privacidad muy cerca con un 51%. Durante el mismo período, la Encuesta de Pruebas de Cumplimiento de la Gestión de Inversiones de 2025 encontró que el 57% de los oficiales de cumplimiento identificaron el uso de IA como su principal preocupación de cumplimiento, y la encuesta de agentes de IA de 2025 de PwC descubrió que el 28% de los líderes empresariales clasifican la falta de confianza en los agentes de IA como una barrera principal para un despliegue más amplio.

El estado de ánimo del público detrás de esos números es aún más frío. Aproximadamente el 70% de los adultos no confían en que las empresas usen la IA de manera responsable, y más del 80% esperan algún nivel de uso indebido de sus datos, según Protecto. Tus clientes ya han asumido lo peor, que es la razón por la que un incidente de mal manejo cuesta reputación mucho antes de que cueste una multa.

Lo cual es el verdadero argumento para dejar todo esto por escrito. Una política de no entrenamiento no es una función que agregas a una tabla comparativa. Es la cosa que decide si el revisor de seguridad firma, y los revisores no firman párrafos. Firman cláusulas.

Así que envíale a Parseur las doce preguntas, luego envíales las idénticas doce a todos los demás en tu lista de preseleccionados. Empieza con el Acuerdo de Procesamiento de Datos y la configuración de retención en tu plan. La comparación es el punto de todo esto, y preferimos que nos lean junto a los demás que en lugar de ellos.

Última actualización el

Deja de meter datos a mano

¿Listo para automatizar la
extracción de datos de tus documentos?

Empieza gratis en minutos y descubre cómo Parseur encaja en tu flujo de trabajo.

Funciona desde el primer documento, sin configuraciones complicadas
Automatiza la extracción de datos de cualquier documento
Tan fácil como un clic, tan potente como una API

Preguntas Frecuentes

Las preguntas a continuación son las que los revisores de seguridad y los equipos de adquisiciones realmente envían a los proveedores de extracción de documentos. Aquí respuestas cortas; las contractuales están en el Acuerdo de Procesamiento de Datos.

"No entrenamiento con tus datos" significa que el proveedor procesa tu contenido para entregarte el resultado que pediste y nunca lo retroalimenta en el entrenamiento, ajuste fino (fine-tuning), evaluación o benchmarking de modelos. Tus documentos son un insumo para el servicio, no materia prima para el producto.

La retención cero de datos (ZDR) significa que un proveedor procesa una solicitud en la memoria y no escribe nada en el disco. Parseur no es de retención cero de datos, y ningún analizador de documentos (parser) que te permita volver a ejecutar una extracción o revisar un resultado anterior puede afirmarlo honestamente. En su lugar, Parseur te ofrece una ventana de retención configurable, a partir de un día en adelante, dependiendo de tu plan.

Parseur está alojado en la UE, es nativo del GDPR y la residencia de los datos se mantiene en la UE. El centro de datos de alojamiento tiene certificación ISO 27001, que es el certificado del centro de datos y no una certificación de Parseur.

Tú eres el controlador de los datos y Parseur es el procesador de los datos. Parseur procesa datos en tu nombre y de acuerdo con tus instrucciones, según los términos de tu Acuerdo de Procesamiento de Datos.

No de manera automática, y es aquí donde la mayoría de las políticas fallan en silencio. Muchos proveedores prometen no entrenar con tus datos mientras se reservan el derecho de entrenar con versiones anonimizadas, desidentificadas, agregadas o derivadas de los mismos. Exige que esa excepción sea nombrada explícitamente y luego cerrada.

Apoyan directamente dos principios básicos. La limitación del propósito significa que los datos se utilizan solo para la tarea que solicitaste, y la minimización de datos significa que no existe ninguna copia secundaria que pueda ser expuesta más tarde. Ninguna de las dos reemplaza a un Acuerdo de Procesamiento de Datos, pero ambas son mucho más difíciles de demostrar sin un compromiso de no entrenamiento.

No. Los datos de los clientes nunca se reutilizan para entrenar los modelos de IA de Parseur y nunca se venden. Cada extracción se ejecuta para producir tu resultado, y nada más.

El tiempo que tú le indiques. El período de retención de documentos es configurable desde un día hasta ilimitado según tu plan, y los documentos se eliminan automáticamente una vez que se cierra la ventana. También puedes eliminarlos a pedido.

GDPR de la UE, GDPR del Reino Unido, CCPA y CPRA de California, y PDPA de Singapur. Los programas de cumplimiento SOC 2 Tipo II e HIPAA están en progreso y en camino para 2026, lo que significa que Parseur no está certificado en ninguno de los dos hoy en día.

Pide la lista por nombre, dónde procesa los datos cada uno, cuánto tiempo los conserva y si tienen prohibido contractualmente utilizar tu contenido para el entrenamiento. Un análisis de DataGrail de 2026 sobre 2.400 proveedores de software empresarial reveló que el 63,6% de los proveedores que anuncian capacidades de IA no revelan un subprocesador de IA de terceros en ninguna parte de su documentación legal.

Ponlos en el Acuerdo de Procesamiento de Datos o en el Acuerdo de Servicios Maestros en lugar de en la política de privacidad, y agrega una cláusula de precedencia para que el documento firmado prevalezca sobre los términos en línea que pueden cambiar sin previo aviso.

Pregunta esto a cada proveedor antes de firmar, incluso si la eliminación alcanza a las copias de seguridad, los registros y las memorias caché, y cuánto tiempo tarda. Con Parseur, tú mantienes el control de la ventana de retención y puedes eliminar documentos a pedido.