Nenhum treinamento com seus dados significa que um fornecedor processa seu conteúdo para entregar o resultado que você solicitou e nunca o reutiliza para treinamento, ajuste fino, avaliação ou benchmarking de um modelo de aprendizado de máquina. Seus documentos são um insumo para o serviço, não matéria-prima para o produto.
Essa frase não custa nada para um fornecedor escrever, e é por isso que seu revisor de segurança parou de aceitá-la. Abaixo estão as 12 perguntas para testá-la, e as respostas do Parseur a elas, incluindo aquelas onde a resposta honesta é "pergunte-nos e exija que isso conste por escrito".
Principais Pontos
- Nenhum treinamento com seus dados garante que seu conteúdo seja processado, mas nunca reciclado em um modelo.
- Qualquer fornecedor pode dizer isso, então as revisões de segurança passaram a focar nas partes que você pode verificar: subprocessadores nomeados, retenção cotada em dias e a exceção de dados anonimizados eliminada.
- O Parseur nunca reutiliza dados de clientes para treinar seus modelos de IA e nunca os vende, é hospedado na UE, é nativo do GDPR e permite que você defina a janela de retenção de documentos de um dia até o período ilimitado.
- Os programas SOC 2 Tipo II e HIPAA estão em andamento e no caminho certo para 2026, o que significa que não há certificação hoje. O Parseur também não é um fornecedor de retenção zero de dados, e esta página explica por que nenhum analisador de documentos que você realmente desejaria pode ser.
Por Que "Nunca Treinamos Com Seus Dados" Deixou de Fazer Sentido
Todo fornecedor diz isso agora. E esse é exatamente o problema.
Um revisor que lê "nunca treinamos com seus dados" em uma página de marketing não aprendeu nada que possa colocar em um registro de riscos. A frase não tem escopo, não nomeia subprocessadores, não cita número de retenção e não carrega a assinatura de ninguém.
A lacuna entre essa frase e o contrato acaba sendo imensa. O Relatório de Tendências de Privacidade e IA de 2026 da DataGrail, que analisou 2.400 provedores populares de software corporativo, descobriu que 63,6% dos fornecedores que anunciam recursos de IA não divulgam um subprocessador de IA de terceiros em nenhum lugar de sua documentação legal.
Alguns desses fornecedores genuinamente não têm nenhum subprocessador para divulgar. O resto está pedindo que você aceite uma cadeia de suprimentos anônima baseada na confiança e, de fora, você não consegue distinguir os dois grupos. Esse é o objetivo de todas as perguntas abaixo.
Portanto, a questão útil não é mais se um fornecedor tem uma política de não treinamento. É o que sobrevive quando você pede que eles escrevam isso.
Processamento vs. Treinamento e Por Que Apenas Um é Reversível
Duas coisas podem acontecer a um documento que você carrega, e a diferença está em saber se algo é deixado para trás quando o trabalho é concluído.
- Processamento: seus dados são usados em tempo real para concluir uma tarefa, como extrair os itens de linha de uma fatura de fornecedor. Quando a tarefa termina, os dados não retornam ao sistema para aprendizado futuro.
- Treinamento: seus dados alimentam um modelo para melhorá-lo, para que suas entradas se tornem parte do que o modelo conhece. Não há como desfazer. Recuperar seu conteúdo significa retreinar o modelo, e ninguém orçou para isso.
Embaçar essa linha criou três problemas que sobreviveram a ela. Documentos confidenciais podiam ser reconstruídos a partir de um modelo que os memorizou. A propriedade tornou-se obscura, porque um modelo treinado em seus contratos absorveu sua propriedade intelectual. E os setores regulamentados perderam a capacidade de responder à pergunta de auditoria mais básica que existe, que é para onde realmente foram os dados do cliente.
Uma política de não treinamento remove a ambiguidade. Seus dados são processados para a tarefa, e então tudo para por aí.
Retenção Zero de Dados e Por Que o Parseur Não Afirma Tê-la
Retenção zero de dados (ZDR - Zero Data Retention) significa que um provedor processa sua solicitação na memória e não grava nada no disco. Nenhum insumo armazenado, nenhum resultado armazenado, nenhum registro de conteúdo. É a postura mais rigorosa disponível, e as equipes de compras cada vez mais a solicitam pelo nome, em vez de perguntar sobre treinamento.
Ela também é constantemente exagerada, então vale a pena saber o que o ZDR tende a deixar de fora.
- Os metadados de cobrança sobrevivem. Registros de data e hora, contagens de tokens e latência precisam ser anotados em algum lugar, ou ninguém pode faturá-lo.
- O monitoramento de abusos e segurança pode ficar totalmente de fora do acordo, o que representa um caminho de revisão humana sobre o qual você nunca foi informado.
- Nem todo endpoint é elegível para ZDR. Chamar um que não seja é uma decisão silenciosa de sair do seu próprio acordo, geralmente tomada por um engenheiro que nunca o leu.
Aqui está a parte que a maioria das páginas de fornecedores ignora. O Parseur não é um produto de retenção zero de dados, e nenhum analisador de documentos que permita reexecutar uma extração ou revisar os resultados do mês passado honestamente pode ser. Reprocessar um documento exige que o documento ainda esteja lá. O que o Parseur lhe dá, em vez disso, é uma janela de retenção que você controla, de um dia até ilimitado, dependendo do seu plano, com exclusão automática no momento em que a janela se fecha.
Se um fornecedor lhe oferecer um histórico completo de documentos e retenção zero de dados ao mesmo tempo, pergunte qual deles ele está prestes a retirar de você.
As 12 Perguntas a Fazer a um Fornecedor de Extração de Documentos Sobre Treinamento de IA e Retenção

Copie isso para o seu questionário de fornecedor. Cada uma tem uma resposta curta se o fornecedor tiver feito o trabalho e uma longa pausa se não o fez.
- Vocês usam nossos documentos enviados, campos extraídos, metadados, correções ou saídas para treinar, fazer o ajuste fino, avaliar ou testar qualquer modelo?
- Essa resposta também cobre versões anonimizadas, desidentificadas, agregadas ou derivadas de nossos dados?
- Quais subprocessadores de IA, OCR ou nuvem de terceiros recebem nossos documentos? Nomeie cada um e diga onde é executado.
- Esses subprocessadores estão contratualmente impedidos de usar nossos dados para treinamento ou melhoria de serviço?
- Por quanto tempo cada tipo de dado é mantido: documentos de origem, campos extraídos, logs de processamento, logs de erro, caches e backups?
- Podemos configurar a janela de retenção nós mesmos e qual é a mais curta que vocês oferecem?
- Podemos excluir dados sob demanda e qual é o SLA de exclusão por escrito?
- A exclusão atinge os backups e quanto tempo até que eles sejam substituídos?
- Seus funcionários ou contratados podem visualizar nossos documentos, em quais circunstâncias, e esse acesso é registrado?
- Os dados do cliente alguma vez são copiados para ambientes de desenvolvimento, teste, QA ou demonstração?
- Onde nossos dados são armazenados e processados e eles podem sair dessa região?
- Esses compromissos constarão no DPA ou MSA assinado e substituirão os termos online caso os dois discordem?
Um fornecedor que responde a todos os doze em um parágrafo suave está adivinhando. Um fornecedor que responde com nomes, números e uma referência de cláusula já foi questionado antes.
As Respostas do Parseur, Incluindo a Mais Delicada

O Parseur é um analisador de documentos. Você envia faturas de fornecedores, ele envia de volta campos estruturados e não treina modelos com os dados dos clientes. Aqui está o que acontece com essas faturas, mapeado para as perguntas acima.
| Pergunta | A resposta do Parseur |
|---|---|
| 1. Treinamento de modelo | Os dados do cliente nunca são reutilizados para treinar os modelos de IA do Parseur e nunca são vendidos. Cada extração é executada para produzir seu resultado e nada mais. |
| 5 e 6. Retenção | O período de retenção do documento é configurável de um dia até ilimitado, dependendo do seu plano. Os documentos são excluídos automaticamente quando a janela se fecha e sob demanda sempre que você solicitar. |
| 11. Localização | Hospedado na UE e nativo do GDPR, com residência de dados mantida na UE. O data center de hospedagem é certificado pela ISO 27001, que é o certificado do data center em vez de uma certificação do Parseur. |
| 12. Funções e papelada | Você é o controlador de dados, o Parseur é o processador de dados e o Acordo de Processamento de Dados (DPA) rege o que isso permite. |
| Regulamentos | Alinhado com o GDPR da UE, GDPR do Reino Unido, CCPA e CPRA da Califórnia e PDPA de Cingapura. Detalhes em Privacidade e GDPR no Parseur. |
| Certificações | Os programas SOC 2 Tipo II e HIPAA estão em andamento e previstos para 2026. O Parseur ainda não é certificado em nenhum deles hoje. |
| Controles de segurança | Criptografia em trânsito e em repouso, permissões baseadas em função e trilhas de auditoria, além de testes de segurança terceirizados regulares. |
| 2, 3, 4, 7, 8, 9 e 10 | Não respondidas nesta página. Pergunte-nos e coloque a resposta no contrato assinado, em vez de em uma página da web que poderíamos editar silenciosamente no próximo trimestre. |
Escrever "em andamento" onde um logotipo ficaria melhor custa um pouco de orgulho e compra muita credibilidade. Um revisor que pega uma certificação exagerada para de acreditar nas outras onze respostas, e tem razão para isso.
Duas dessas linhas você pode verificar antes de falar com qualquer pessoa. O Acordo de Processamento de Dados é um documento que você pode ler na íntegra antes de assinar, e a janela de retenção é uma configuração que você pode ver em sua própria conta, em vez de uma promessa sobre uma.
O Que OpenAI, Microsoft, Anthropic, AWS e Google Realmente Se Comprometem A Fazer
Os compradores corporativos arrastaram todo o mercado para garantias explícitas, e o formato de uma boa resposta agora está consolidado.
- OpenAI se divide por produto. Dados do consumidor do ChatGPT podem ser usados para melhorar modelos, enquanto os níveis corporativo e de API são excluídos por padrão, com controles de opt-out documentados.
- Microsoft aposta no isolamento. O Copilot para Microsoft 365 e o Azure OpenAI excluem o conteúdo do cliente do treinamento do modelo de base e publicam uma janela de retenção padrão para dados de processamento transitórios.
- Anthropic compromete-se publicamente a não treinar modelos com dados corporativos.
- Google Cloud e AWS publicam exclusões de treinamento para Document AI e Textract em seus termos de governança de dados, embora a AWS exija que você aplique uma política de opt-out explícita no nível da organização, em vez de usá-la como padrão. Excluído por padrão e excluído depois que alguém se lembra de clicar não é o mesmo compromisso.
Observe o que eles têm em comum. A resposta reside em um documento de governança, em vez de em uma postagem de blog, e chega com um padrão nomeado. Esse é o sarrafo, e é o sarrafo que esta página está tentando superar.
Por Que Essa Questão Agora Impede Compras
Os compradores não estão perguntando por curiosidade. Uma pesquisa de 2025 pelo The Futurum Group descobriu que 52% das organizações priorizam a experiência técnica dos fornecedores de IA, com o manuseio de dados e controles de privacidade logo atrás, com 51%. Durante o mesmo período, a Pesquisa de Testes de Conformidade em Gestão de Investimentos 2025 descobriu que 57% dos oficiais de conformidade identificaram o uso da IA como sua principal preocupação de conformidade, e a pesquisa sobre agentes de IA da PwC de 2025 descobriu que 28% dos líderes de negócios classificam a falta de confiança nos agentes de IA como a principal barreira para uma implantação mais ampla.
O humor do público sob esses números é ainda mais frio. Aproximadamente 70% dos adultos não confiam nas empresas para usarem a IA com responsabilidade, e mais de 80% esperam algum nível de uso indevido de seus dados, de acordo com a Protecto. Seus clientes já assumiram o pior, e é por isso que um incidente de manuseio incorreto custa a reputação muito antes de custar uma multa.
O que é o verdadeiro argumento para colocar tudo isso por escrito. Uma política de não treinamento não é um recurso que você adiciona a uma tabela de comparação. É a coisa que decide se o revisor de segurança assina, e revisores não assinam parágrafos. Eles assinam cláusulas.
Então, envie as doze perguntas ao Parseur e envie as mesmas doze para todos os outros em sua lista restrita. Comece com o Acordo de Processamento de Dados (DPA) e as configurações de retenção do seu plano. A comparação é o objetivo principal, e preferimos ser lidos lado a lado aos outros do que em vez deles.
Última atualização em




