Come copiare testo da un PDF - 6 modi, anche quando non è consentito

Per copiare il testo da un PDF, apri il file in un browser o in un lettore PDF, trascina il cursore sul testo che desideri e premi Ctrl+C su Windows o Cmd+C su un Mac. In un PDF normale, questo è tutto l'articolo.

Poi c'è l'altro tipo. La scansione in cui il tuo cursore trascina una casella blu sulla pagina e non afferra altro che aria. Il file il cui autore ha disattivato la copia, così che Ctrl+C ti restituisca un cortese rifiuto. Di seguito sei metodi, più il momento in cui copiare smette del tutto di essere lo strumento giusto.

Come copiare e incollare testo da PDF

Sei metodi, approssimativamente nell'ordine in cui li useresti. PDF normale, inizia dal metodo 1. Scansione, passa al metodo 3. File che blocca la copia, metodo 6.

Metodo 1: Adobe Acrobat Reader

Adobe Reader è l'app desktop di Adobe per leggere e annotare PDF, e gestisce bene le copie semplici.

  1. Usa il mouse per cliccare e trascinare sul testo che desideri copiare.
  2. Fai clic con il tasto destro e seleziona "Copia" o usa CTRL + C (Windows) e Comando + C (Mac).
  3. Fai clic con il tasto destro e seleziona "Incolla", oppure premi Ctrl+V (Windows) o Cmd+V (Mac) per incollare il testo.

Right-clicking selected text in Adobe Reader to copy it
Right click and select copy

Salta l'installazione se preferisci non disturbarti. Trascina il PDF in una scheda di Chrome, Edge o Safari e seleziona il testo lì, stesse scorciatoie.

Ideale per prendere un paragrafo o due. I layout complessi arrivano negli appunti con la loro formattazione rimescolata, e i PDF scansionati non ti restituiscono nulla.

Metodo 2: Microsoft Word

Word non copia il testo, ricostruisce il documento, motivo per cui mantiene la formattazione che un copia-incolla appiattirebbe. Questo è il metodo da utilizzare quando si desidera copiare il testo da un PDF a Word.

  1. Apri Word, clicca su "File" poi su "Apri", e scegli il tuo PDF.
  2. Clicca su "Apri". Word avverte che sta per convertire il file. Lasciaglielo fare.
  3. Copia il testo di cui hai bisogno dal documento convertito.

Microsoft Word converting a PDF file
Wait for Word to convert the PDF

I documenti semplici passano con la maggior parte della loro formattazione intatta.

A converted PDF open as an editable document in Microsoft Word
PDF document in MS Word

Le pagine a più colonne e i report con un design complesso sono i punti in cui la conversione diventa creativa. Controllali prima di fidarti.

Metodo 3: Google Documenti

Google Documenti esegue l'OCR durante l'importazione, il che lo rende il percorso più breve verso il testo all'interno di un PDF scansionato. Carica prima il file su Google Drive.

A PDF file uploaded to Google Drive
Upload the PDF to Google Drive

  1. Fai clic con il tasto destro sul documento, seleziona "Apri con" e quindi scegli "Google Documenti".
  2. Seleziona il testo di cui hai bisogno e incollalo dove ti serve.

Opening a PDF with Google Docs from the Google Drive menu
Open with Google docs

Documenti legge la pagina e restituisce un documento modificabile. Le parole arrivano. Il design no, come rende dolorosamente chiaro lo screenshot qui sotto.

A PDF converted into an editable Google Doc
Select the text you need

Metodo 4: Convertitori online da PDF a testo

I convertitori trasformano un intero documento in testo semplice in un solo passaggio, che è ciò che desideri quando il layout non ha importanza. PDF to Text e PDF2Go fanno entrambi il lavoro. Con PDF2Go:

  1. Carica il file tramite drag and drop, oppure da Google Drive o Dropbox.

A PDF being uploaded to the PDF2Go converter
Upload PDF to pdf2go

  1. Scegli le tue impostazioni, clicca su "Avvia" e attendi la conversione.
  2. Scarica il file di testo, quindi copia e incolla ciò che ti serve.

Due cose da valutare prima di caricare. Questi strumenti eseguono l'OCR tradizionale (riconoscimento ottico dei caratteri), che legge i caratteri senza capirne il significato, quindi ottieni testo anziché dati utilizzabili. E stai consegnando il tuo documento al server di uno sconosciuto, il che merita un secondo di riflessione quando il file contiene uno stipendio, una diagnosi o un contratto.

Metodo 5: Librerie Python

Se hai dimestichezza con il codice, pypdf o l'Adobe PDF Services API lo faranno programmaticamente. pypdf è una libreria Python open-source per leggere, dividere, unire e trasformare le pagine PDF, ed è il successore mantenuto di PyPDF2. L'API di Adobe copre un ambito simile come servizio a pagamento.

Un solo inconveniente. pypdf legge il livello di testo, quindi una scansione ritorna come una stringa vuota e una piccola crisi di fiducia. Abbinalo a un passaggio OCR per quelli.

Metodo 6: Cattura del testo dallo schermo

Ogni principale sistema operativo può ora prelevare il testo direttamente dallo schermo, che è la via di fuga quando un PDF si rifiuta di collaborare.

Su Windows 11, apri lo Strumento di cattura, acquisisci la regione della pagina e usa Azioni testo per estrarre le parole. Su un Mac, Testo attivo fa lo stesso da uno screenshot in Anteprima. Su iPhone e Android, tieni premuto a lungo il testo all'interno di uno screenshot.

Funziona sulle scansioni e sui file in cui la selezione è bloccata, che è più di quanto gestiscano la maggior parte dei metodi. Si limita anche a ciò che entra in una sola schermata. Uno strumento di salvataggio, non un flusso di lavoro.

Perché non riesco a copiare il testo da questo PDF?

Se non riesci a selezionare alcun testo in un PDF, ci sono solo due probabili cause, e distinguerle richiede circa un secondo.

Il tuo cursore disegna una casella su tutta la pagina. Il PDF è una scansione o un'immagine. Non c'è alcun livello di testo, solo un'immagine del testo, quindi nessuna quantità di clic atterrerà su una parola. Hai bisogno dell'OCR, che è ciò che lo trasforma in un PDF ricercabile. Google Documenti, Metodo 3 sopra, è il modo più rapido per farlo una volta.

Il tuo cursore evidenzia le parole ma Ctrl+C non produce nulla. La copia è disattivata nelle autorizzazioni del file. In Acrobat Reader, fai clic con il tasto destro sulla pagina, scegli Proprietà documento e controlla la scheda Sicurezza per vedere esattamente cosa l'autore ha consentito. Se la copia del contenuto è disattivata, la mossa giusta è chiedere al mittente una versione senza restrizioni o la password. Se il documento è tuo, rimuovi la restrizione da quello stesso pannello.

Dove il copia-incolla fallisce

Tutti e sei i metodi condividono un limite, e lo raggiungi prima di quanto ti aspetti.

  • La formattazione sopravvive raramente agli appunti. Font, dimensioni e colonne arrivano come suggerimenti.
  • Le tabelle escono come un groviglio, perché gli appunti non hanno il concetto di righe e colonne.
  • L'OCR tradizionale è preciso fino a quando la scansione non è storta, sbiadita o densa.
  • I convertitori online inviano il tuo documento in un viaggio di andata e ritorno attraverso il server di qualcun altro.
  • Copia una cifra sbagliata nel totale di una fattura e sei messo peggio che senza dati del tutto.
  • E qualsiasi cosa tu abbia copiato deve ancora essere digitata o importata nel sistema che ne aveva effettivamente bisogno.

Nulla di tutto ciò ha importanza per un singolo documento. Ne ha un'enormità per il cinquantesimo questo mese.

Cosa legge l'IA che gli appunti non possono leggere

L'estrazione di testo basata sull'IA legge un documento nel modo in cui lo fa una persona, capendo cosa significa il layout invece di dove si trova l'inchiostro. Questa è la differenza tra recuperare testo e ottenere dati che puoi usare.

L'OCR tradizionale ti dà una pagina di caratteri e ti lascia a cercare il numero di fattura. Un motore IA restituisce il numero di fattura.

Perché un parser IA gestisce meglio questa operazione

Parseur può estrarre testo specifico dai documenti PDF indipendentemente da cosa il layout presenti.

Crea il tuo account gratuito
Risparmia tempo e fatica con Parseur. Automatizza i tuoi documenti.
  • Ogni fornitore formatta le proprie scartoffie in modo diverso. Tu elenchi i campi una volta sola e nessuno costruisce un modello per ogni mittente.
  • Le tabelle restano tabelle. Parseur può estrarre tabelle dai PDF come righe e colonne invece di testo sciolto.
  • Le scansioni vengono lette in ingresso, dall'OCR Zonale quando il layout è fisso e dall'OCR Dinamico quando non lo è.
  • I tuoi documenti restano tuoi. Parseur è conforme al GDPR, con certificazione SOC 2 Type II in corso.

Parseur fornisce quindi il risultato negli strumenti che già utilizzi, così nessuno lo copia e incolla una seconda volta. Questo è il PDF parsing piuttosto che la copia, ed è un lavoro diverso.

Come copiare testo da un PDF scansionato con Parseur

L'impostazione richiede pochi minuti e nessuna carta di credito.

  1. Crea una casella di posta e scegli il motore IA. Il motore Vision AI legge PDF, scansioni e immagini. Il motore Text AI legge email e documenti di testo.

Creating a Parseur mailbox for incoming documents
Create a mailbox for your documents

  1. Elenca i campi che desideri. L'IA li trova nei vari layout, senza alcun modello da costruire.

Listing the fields to extract in Parseur
List the fields you want extracted

  1. Invia il PDF scansionato tramite email, caricamento o API.
  2. Esamina i risultati ottenuti.

Text extracted from a scanned PDF in Parseur
Text extract from scanned PDF

Lavori con un solo tipo di documento? Inizia dalla casella di posta corrispondente e i campi tornano già nominati. Le fatture iniziano con la casella "Fatture".

Creating an invoice mailbox in Parseur
Create an AI invoice mailbox

Dove vanno i dati successivamente

  1. Scarica il testo in formato CSV o JSON.
  2. Invia i dati a un Foglio di lavoro Google.
  3. Esporta i dati in qualsiasi applicazione tramite Zapier, Make o Power Automate.

Copiare testo da un PDF richiede due secondi. Copiarlo dai prossimi cinquecento è un lavoro che non dovrebbe essere affidato a nessuno. Prova Parseur sulla pila che stavi evitando.

A review from a Parseur customer
Review by a happy customer

Ultimo aggiornamento il

Inizia subito

Pronto ad automatizzare
l’estrazione dati dai tuoi documenti?

Inizia gratis in pochi minuti e scopri come Parseur si integra nel tuo flusso di lavoro.

Nessun modello da addestrare
Automatizza l’inserimento dati da qualsiasi documento
Dalla web app all'API, scala con te

Domande frequenti

Le domande che le persone fanno davvero quando un PDF si rifiuta di collaborare.

Apri il PDF in un browser o un lettore PDF, trascina il cursore sul testo che desideri, quindi premi Ctrl+C su Windows o Cmd+C su un Mac. Incollalo con Ctrl+V o Cmd+V. Se desideri il testo senza i font e la spaziatura originali, incollalo con Ctrl+Shift+V, oppure incollalo prima in un editor di testo semplice e copialo nuovamente da lì.

Un PDF scansionato non ha testo selezionabile, quindi deve essere letto tramite OCR prima di poter copiare qualsiasi cosa. Caricare il file su Google Drive e aprirlo con Google Documenti esegue automaticamente l'OCR ed è la strada più breve per un singolo documento. Per documenti regolari o grandi volumi, un parser IA legge la scansione e restituisce campi strutturati anziché un blocco di testo recuperato.

Non fare copia e incolla. Apri il PDF direttamente in Microsoft Word usando File poi Apri, e lascia che Word lo converta. Word ricostruisce intestazioni, elenchi e la maggior parte delle tabelle, cosa che un copia e incolla non può fare. La conversione non è perfetta su layout a più colonne o pagine con un design complesso, quindi controlla tutto ciò che ha colonne prima di fidarti.

Smetti di copiare e lascia che i documenti vengano letti per te. Il copia e incolla manuale smette di avere senso intorno al decimo file, e non sopravvive mai come processo ricorrente. Invece, fai in modo che i PDF arrivino via email, caricamento o API e vengano letti automaticamente, con i campi che ti interessano che finiscono in un foglio di calcolo o nel tuo sistema. Questo è il PDF parsing (analisi PDF) piuttosto che la copia, ed è per questo che sono stati creati strumenti come Parseur.

Ci sono due motivi comuni. O il PDF è una scansione o un'immagine, quindi non c'è alcun livello di testo da selezionare, oppure il file ha le autorizzazioni di copia disattivate da chi lo ha creato. Puoi distinguere i due casi in un secondo: se il cursore evidenzia le singole parole, il livello di testo esiste e il problema sono le autorizzazioni. Se invece il cursore disegna una casella sull'intera pagina, è un'immagine e hai bisogno dell'OCR.

Verifica prima se la copia è effettivamente bloccata. In Acrobat Reader, fai clic con il tasto destro sul documento, scegli Proprietà documento e guarda la scheda Sicurezza per vedere quali autorizzazioni ha concesso l'autore. Se la copia del contenuto non è consentita, la strada corretta è chiedere a chi ti ha inviato il file una copia senza restrizioni o la password. Se il documento è tuo e hai la password, puoi aprirlo in Acrobat e rimuovere la sicurezza dallo stesso pannello Proprietà documento.

Sì, sia su iOS che su Android, purché il PDF abbia un vero livello di testo. Aprilo in File, Libri o Drive, tieni premuta una parola per avviare una selezione, trascina le maniglie, quindi tocca Copia. Se tenendo premuto non si seleziona nulla, la pagina è un'immagine e hai bisogno dell'OCR. Su iOS puoi anche puntare la fotocamera su una pagina stampata e usare Testo attivo (Live Text) per rilevare le parole direttamente.

Parseur fa di più che copiare il testo. Il suo motore Vision AI legge PDF, scansioni e immagini, e il suo motore Text AI legge email e documenti di testo, restituendo campi nominativi come numero di fattura, data e totale piuttosto che un blocco di testo grezzo. Elenchi i campi che desideri e l'IA li trova attraverso i vari layout, senza alcun modello da costruire per ogni mittente. Parseur è conforme al GDPR, con certificazione SOC 2 Type II in corso.