Dire Nessun Addestramento sui Tuoi Dati è Facile - 12 Domande per Verificarlo

Nessun addestramento sui tuoi dati significa che un fornitore elabora i tuoi contenuti per fornirti il risultato richiesto e non li reinserisce mai nell'addestramento, perfezionamento, valutazione o benchmarking di un modello di machine learning. I tuoi documenti sono un input per il servizio, non materia prima per il prodotto.

Scrivere questa frase non costa nulla a un fornitore, motivo per cui il tuo revisore della sicurezza ha smesso di accettarla. Di seguito ci sono le 12 domande per metterla alla prova e le risposte di Parseur, incluse quelle per cui la risposta onesta è "chiedicelo e vincolaci per iscritto".

Punti Chiave

  • Nessun addestramento sui tuoi dati garantisce che i tuoi contenuti vengano elaborati, mai riciclati all'interno di un modello.
  • Qualsiasi fornitore può dirlo, quindi le revisioni di sicurezza si sono spostate sulle parti che puoi verificare: sub-responsabili indicati per nome, tempi di conservazione citati in giorni e chiusura delle eccezioni sui dati anonimizzati.
  • Parseur non riutilizza mai i dati dei clienti per addestrare i suoi modelli AI e non li vende mai, è ospitato in UE e nativo GDPR, e ti consente di impostare la finestra di conservazione dei documenti da un giorno a illimitato.
  • SOC 2 Type II e HIPAA sono in corso e in linea per il 2026, il che significa che non è certificato oggi. Parseur non è nemmeno un fornitore a conservazione zero dei dati (ZDR), e questa pagina spiega perché nessun parser di documenti che vorresti effettivamente usare può esserlo.

Perché "Non Addestriamo Mai sui Tuoi Dati" Ha Smesso di Significare Qualcosa

Ormai lo dicono tutti i fornitori. Il che è esattamente il problema.

Un revisore che legge "non addestriamo mai sui tuoi dati" su una pagina di marketing non ha imparato nulla che possa inserire in un registro dei rischi. La frase non ha un perimetro d'azione, non nomina i sub-responsabili, non cita alcun numero sui tempi di conservazione e non porta la firma di nessuno.

Il divario tra quella frase e il contratto si rivela essere ampio. Il Privacy and AI Trends Report 2026 di DataGrail, che ha analizzato 2.400 fornitori di software aziendale diffusi, ha rilevato che il 63,6% dei fornitori che pubblicizzano funzionalità AI non divulga un sub-responsabile AI di terze parti in nessuna parte della loro documentazione legale.

Alcuni di quei fornitori non hanno sinceramente alcun sub-responsabile da divulgare. Gli altri ti chiedono di accettare sulla fiducia una catena di approvvigionamento senza nome, e dall'esterno non puoi distinguere i due gruppi. Questo è l'intero scopo delle domande qui sotto.

Quindi la domanda utile non è più se un fornitore abbia una politica di non-addestramento. È cosa sopravvive quando gli chiedi di metterla per iscritto.

Trattamento vs Addestramento, e Perché Solo Uno è Reversibile

Possono accadere due cose a un documento che carichi, e la differenza sta se rimane qualcosa quando il lavoro è finito.

  • Trattamento (Processing): i tuoi dati vengono utilizzati in tempo reale per completare un'attività, come l'estrazione delle voci da una fattura di un fornitore. Quando l'attività finisce, i dati non rientrano nel sistema per l'apprendimento futuro.
  • Addestramento (Training): i tuoi dati vengono inseriti in un modello per migliorarlo, in modo che i tuoi input diventino parte di ciò che il modello sa. Non c'è un comando annulla. Recuperare i tuoi contenuti significa riaddestrare il modello, e nessuno ha previsto un budget per questo.

Confondere questo confine ha creato tre problemi che sono sopravvissuti alla confusione stessa. I documenti riservati potevano essere ricostruiti a partire da un modello che li aveva memorizzati. La proprietà è diventata torbida, perché un modello addestrato sui tuoi contratti ha assorbito la tua proprietà intellettuale. E le industrie regolamentate hanno perso la capacità di rispondere alla domanda di audit più basilare che ci sia, ovvero dove sono finiti effettivamente i dati dei clienti.

Una politica di non-addestramento elimina l'ambiguità. I tuoi dati vengono elaborati per l'attività, e poi tutto si ferma.

Zero Data Retention (Conservazione Zero dei Dati), e Perché Parseur Non la Dichiara

La conservazione zero dei dati (Zero Data Retention - ZDR) significa che un provider elabora la tua richiesta in memoria e non scrive nulla su disco. Nessun input archiviato, nessun output archiviato, nessun log dei contenuti. È l'approccio più rigoroso disponibile e i team di approvvigionamento lo chiedono sempre più spesso per nome invece di fare domande sull'addestramento.

È anche un concetto costantemente sopravvalutato, quindi conviene sapere cosa la ZDR tende a omettere.

  • I metadati di fatturazione sopravvivono. Timestamp, conteggi dei token e latenza devono essere scritti da qualche parte, altrimenti nessuno può fatturarti.
  • Il monitoraggio degli abusi e della sicurezza può trovarsi del tutto al di fuori dell'accordo, rivelandosi un percorso di revisione umana di cui non ti è mai stato parlato.
  • Non tutti gli endpoint sono idonei per la ZDR. Chiamarne uno che non lo è rappresenta una decisione silenziosa di uscire dal proprio accordo, di solito presa da un ingegnere che non lo ha mai letto.

Ecco la parte che la maggior parte delle pagine dei fornitori salta. Parseur non è un prodotto a conservazione zero dei dati, e nessun parser di documenti che ti permetta di rieseguire un'estrazione o rivedere i risultati del mese scorso può onestamente esserlo. Rielaborare un documento richiede che il documento sia ancora lì. Ciò che Parseur ti dà invece è una finestra di conservazione che controlli tu, da un giorno fino a illimitato a seconda del tuo piano, con eliminazione automatica nel momento in cui la finestra si chiude.

Se un fornitore ti offre una cronologia completa dei documenti e al tempo stesso la conservazione zero dei dati, chiedi quale delle due sta per portarti via.

Le 12 Domande da Fare a un Fornitore di Estrazione Documenti sull'Addestramento AI e la Conservazione

Infografica checklist delle domande da fare a un fornitore di estrazione documenti su addestramento AI, sub-responsabili e conservazione dati
Le domande da inviare al tuo fornitore

Copia queste domande nel tuo questionario per i fornitori. Ciascuna ha una risposta breve se il fornitore ha fatto i compiti, e una lunga pausa se non li ha fatti.

  1. Utilizzate i nostri documenti caricati, i campi estratti, i metadati, le correzioni o gli output per addestrare, perfezionare, valutare o fare benchmarking su qualsiasi modello?
  2. Questa risposta copre anche le versioni anonimizzate, de-identificate, aggregate o derivate dei nostri dati?
  3. Quali sub-responsabili di terze parti (AI, OCR o cloud) ricevono i nostri documenti? Nomina ciascuno e dì dove viene eseguito.
  4. A questi sub-responsabili è contrattualmente vietato l'utilizzo dei nostri dati per l'addestramento o il miglioramento del servizio?
  5. Per quanto tempo viene conservato ciascun tipo di dato: documenti di origine, campi estratti, log di elaborazione, log degli errori, cache e backup?
  6. Possiamo configurare noi stessi la finestra di conservazione, e qual è la più breve che offrite?
  7. Possiamo eliminare i dati su richiesta, e qual è l'SLA di eliminazione per iscritto?
  8. L'eliminazione raggiunge i backup, e quanto tempo passa prima che vengano sovrascritti?
  9. I vostri dipendenti o appaltatori possono visualizzare i nostri documenti? In quali circostanze? Questo accesso è registrato nei log?
  10. I dati dei clienti vengono mai copiati in ambienti di sviluppo, test, QA o demo?
  11. Dove sono archiviati ed elaborati i nostri dati, e possono mai lasciare quella regione?
  12. Questi impegni risiederanno nel DPA o MSA firmato e prevarranno sui vostri termini online se i due non dovessero concordare?

Un fornitore che risponde a tutte e dodici in un unico e fluido paragrafo sta tirando a indovinare. Un fornitore che risponde con nomi, numeri e il riferimento di una clausola si è già sentito porre queste domande in passato.

Le Risposte di Parseur, Compresa Quella Scomoda

Infografica che mostra come Parseur elabora i documenti dei clienti senza usarli per addestrare modelli AI
Come Parseur applica questa politica

Parseur è un parser di documenti. Tu invii fatture dei fornitori, lui ti restituisce campi strutturati e non si addestra sui dati dei clienti. Ecco cosa succede a quelle fatture, mappato sulle domande qui sopra.

Domanda Risposta di Parseur
1. Addestramento del modello I dati dei clienti non vengono mai riutilizzati per addestrare i modelli AI di Parseur e non vengono mai venduti. Ogni estrazione viene eseguita per produrre il tuo output e nient'altro.
5 e 6. Conservazione Il periodo di conservazione dei documenti è configurabile da un giorno a illimitato, a seconda del tuo piano. I documenti vengono eliminati automaticamente alla chiusura della finestra, e su richiesta ogni volta che lo chiedi.
11. Posizione Ospitato in UE e nativo GDPR, con la residenza dei dati mantenuta nell'UE. Il data center di hosting è certificato ISO 27001, che è il certificato del data center piuttosto che una certificazione di Parseur.
12. Ruoli e documentazione Tu sei il titolare del trattamento dei dati (data controller), Parseur è il responsabile (data processor), e l'Accordo sul Trattamento dei Dati governa ciò che questo consente.
Normative Allineato con GDPR dell'UE, GDPR del Regno Unito, CCPA e CPRA della California e PDPA di Singapore. Dettagli su Privacy e GDPR in Parseur.
Certificazioni I programmi SOC 2 Type II e HIPAA sono in corso e in linea per il 2026. Parseur non è ancora certificato per nessuno dei due ad oggi.
Controlli di sicurezza Crittografia in transito e a riposo, permessi basati sui ruoli e percorsi di audit, oltre a regolari test di sicurezza di terze parti.
2, 3, 4, 7, 8, 9 e 10 Non trovano risposta su questa pagina. Chiedicelo e metti la risposta nell'accordo firmato piuttosto che in una pagina web che potremmo tranquillamente modificare nel prossimo trimestre.

Scrivere "in corso" dove un logo farebbe una figura migliore costa un po' di spavalderia ma compra molta credibilità. Un revisore che scopre una singola certificazione esagerata smette di credere alle altre undici risposte, e fa bene.

Due di quelle righe puoi verificarle prima ancora di parlare con qualcuno. L'Accordo sul Trattamento dei Dati (DPA) è un documento che puoi leggere per intero prima di firmare, e la finestra di conservazione è un'impostazione che puoi vedere nel tuo account, non una semplice promessa a riguardo.

Crea il tuo account gratuito
Risparmia tempo e fatica con Parseur. Automatizza i tuoi documenti.

Cosa Si Impegnano Effettivamente a Fare OpenAI, Microsoft, Anthropic, AWS e Google

Gli acquirenti aziendali hanno trascinato l'intero mercato verso garanzie esplicite e la forma di una buona risposta è ormai stabilita.

  • OpenAI si divide per prodotto. I dati consumer di ChatGPT possono essere utilizzati per migliorare i modelli, mentre i livelli enterprise e le API sono esclusi per impostazione predefinita, con i controlli di opt-out documentati.
  • Microsoft si affida all'isolamento. Copilot per Microsoft 365 e Azure OpenAI escludono i contenuti dei clienti dall'addestramento dei foundation model e pubblicano una finestra di conservazione predefinita per i dati di elaborazione temporanei.
  • Anthropic si impegna pubblicamente a non effettuare addestramenti sui dati aziendali.
  • Google Cloud e AWS pubblicano entrambi esclusioni sull'addestramento per Document AI e Textract nei loro termini di governance dei dati, sebbene AWS richieda l'applicazione di una politica esplicita di opt-out a livello organizzativo piuttosto che impostarla di default. Escluso di default ed escluso quando qualcuno si ricorda di fare clic non sono lo stesso livello di impegno.

Nota cosa hanno in comune. La risposta vive all'interno di un documento di governance piuttosto che in un post sul blog e si presenta con un'impostazione predefinita dichiarata. Questo è lo standard e questo è lo standard che questa pagina sta cercando di superare.

Perché Questa Domanda Ora Blocca gli Acquisti

Gli acquirenti non chiedono per curiosità. Un sondaggio del 2025 condotto da The Futurum Group ha rivelato che il 52% delle organizzazioni dà la priorità alle competenze tecniche dei fornitori di AI, seguite a ruota dalla gestione dei dati e dai controlli sulla privacy con il 51%. Nello stesso periodo, il Sondaggio 2025 sull'Investment Management Compliance ha rilevato che il 57% dei responsabili compliance ha identificato l'uso dell'AI come la principale preoccupazione di conformità, e il sondaggio 2025 sugli agenti AI di PwC ha rilevato che il 28% dei leader aziendali classifica la mancanza di fiducia negli agenti AI come un ostacolo principale a una loro implementazione più ampia.

L'umore pubblico alla base di questi numeri è ancora più freddo. Circa il 70% degli adulti non si fida del fatto che le aziende utilizzino l'AI in modo responsabile e oltre l'80% si aspetta qualche livello di uso improprio dei propri dati, secondo Protecto. I tuoi clienti hanno già presunto il peggio, motivo per cui un incidente di cattiva gestione costa in reputazione molto prima che in sanzioni pecuniarie.

Questo è il vero argomento per mettere tutto questo per iscritto. Una politica di non-addestramento non è una funzione che aggiungi a una tabella di confronto. È l'elemento che decide se il revisore della sicurezza firmerà o meno, e i revisori non firmano paragrafi. Firmano clausole.

Quindi invia a Parseur le dodici domande, e poi invia le stesse dodici a tutti gli altri nella tua shortlist. Inizia dall'Accordo sul Trattamento dei Dati (DPA) e dalle impostazioni di conservazione del tuo piano. Il confronto è il punto fondamentale, e preferiamo essere letti accanto agli altri piuttosto che al posto loro.

Ultimo aggiornamento il

Inizia subito

Pronto ad automatizzare
l’estrazione dati dai tuoi documenti?

Inizia gratis in pochi minuti e scopri come Parseur si integra nel tuo flusso di lavoro.

Nessun modello da addestrare
Automatizza l’inserimento dati da qualsiasi documento
Dalla web app all'API, scala con te

Domande Frequenti

Le domande qui sotto sono quelle che i revisori della sicurezza e i team di approvvigionamento inviano effettivamente ai fornitori di estrazione dati. Risposte brevi qui, risposte contrattuali nell'Accordo sul Trattamento dei Dati (DPA).

Nessun addestramento sui tuoi dati significa che il fornitore elabora i tuoi contenuti per fornirti il risultato richiesto e non li reinserisce mai nell'addestramento, nel perfezionamento, nella valutazione o nel benchmarking del modello. I tuoi documenti sono un input per il servizio, non materia prima per il prodotto.

Zero data retention (ZDR), o conservazione zero dei dati, significa che un provider elabora una richiesta in memoria e non scrive nulla su disco. Parseur non è a conservazione zero dei dati, e nessun parser di documenti che ti permetta di rieseguire un'estrazione o rivedere un risultato passato può onestamente dichiararlo. Parseur ti offre invece una finestra di conservazione configurabile, da un giorno in su a seconda del tuo piano.

Parseur è ospitato in UE e nativo GDPR, e la residenza dei dati è mantenuta nell'UE. Il data center di hosting è certificato ISO 27001, che è il certificato del data center piuttosto che una certificazione di Parseur.

Tu sei il titolare del trattamento (data controller) e Parseur è il responsabile del trattamento (data processor). Parseur tratta i dati per tuo conto e secondo le tue istruzioni, ai termini del tuo Accordo sul Trattamento dei Dati (DPA).

Non automaticamente, ed è qui che la maggior parte delle politiche trapela silenziosamente. Molti fornitori promettono di non addestrare sui tuoi dati riservandosi però il diritto di addestrare su versioni anonimizzate, de-identificate, aggregate o derivate di essi. Chiedi che questa clausola di esclusione venga esplicitata e poi chiusa.

Supportano direttamente due principi fondamentali. Limitazione delle finalità significa che i dati vengono utilizzati solo per l'attività richiesta, e minimizzazione dei dati significa che non esiste alcuna copia secondaria da esporre in seguito. Nessuno dei due sostituisce un Accordo sul Trattamento dei Dati, ma entrambi sono molto più difficili da dimostrare senza un impegno di non-addestramento.

No. I dati dei clienti non vengono mai riutilizzati per addestrare i modelli AI di Parseur e non vengono mai venduti. Ogni estrazione viene eseguita solo per produrre il tuo output e nient'altro.

Per tutto il tempo che desideri. Il periodo di conservazione dei documenti è configurabile da un giorno a illimitato a seconda del tuo piano, e i documenti vengono eliminati automaticamente alla chiusura della finestra. Puoi anche eliminarli su richiesta.

GDPR dell'UE, GDPR del Regno Unito, CCPA e CPRA della California e PDPA di Singapore. I programmi di conformità SOC 2 Type II e HIPAA sono in corso e in linea per il 2026, il che significa che oggi Parseur non è ancora certificato per nessuno dei due.

Chiedi l'elenco nominativo, dove ciascuno elabora i dati, per quanto tempo li conserva e se è contrattualmente escluso dall'utilizzo dei tuoi contenuti per l'addestramento. Un'analisi DataGrail del 2026 su 2.400 fornitori di software aziendale ha rilevato che il 63,6% dei fornitori che pubblicizzano funzionalità AI non divulgano un sub-responsabile AI di terze parti in nessuna parte della loro documentazione legale.

Inseriscili nell'Accordo sul Trattamento dei Dati (DPA) o nel Contratto Quadro sui Servizi (MSA) piuttosto che nella politica sulla privacy, e aggiungi una clausola di prevalenza in modo che il documento firmato annulli i termini online che possono cambiare senza preavviso.

Chiedilo a ogni fornitore prima di firmare, incluso se l'eliminazione raggiunge backup, log e cache, e quanto tempo ci vuole. Con Parseur, mantieni il controllo della finestra di conservazione e puoi eliminare i documenti su richiesta.