Jak skopiować tekst z pliku PDF – 6 sposobów, nawet gdy plik na to nie pozwala

Aby skopiować tekst z pliku PDF, otwórz go w przeglądarce lub czytniku PDF, przeciągnij kursorem po wybranym tekście i naciśnij Ctrl+C (Windows) lub Cmd+C (Mac). W przypadku zwykłego pliku PDF to by było na tyle w tym artykule.

Są jednak też inne przypadki. Skan, w którym kursor rysuje niebieską ramkę na stronie i nie chwyta niczego poza pustym miejscem. Plik, którego autor wyłączył kopiowanie, więc Ctrl+C kończy się grzeczną odmową. Poniżej przedstawiamy sześć metod, a także moment, w którym kopiowanie przestaje być właściwym rozwiązaniem.

Jak kopiować i wklejać tekst z pliku PDF

Sześć metod, uporządkowanych mniej więcej w kolejności, w jakiej powinieneś po nie sięgnąć. Jeśli masz zwykły PDF, zacznij od metody 1. Skan – przejdź do metody 3. Plik, który blokuje kopiowanie – metoda 6.

Metoda 1: Adobe Acrobat Reader

Adobe Reader to aplikacja komputerowa firmy Adobe do czytania i oznaczania plików PDF, która dobrze radzi sobie z prostym kopiowaniem.

  1. Użyj myszki, aby kliknąć i przeciągnąć kursor po tekście, który chcesz skopiować.
  2. Kliknij prawym przyciskiem myszy i wybierz "Kopiuj" lub użyj CTRL + C (Windows) i Command + C (Mac).
  3. Kliknij prawym przyciskiem myszy i wybierz "Wklej" lub naciśnij Ctrl+V (Windows) albo Cmd+V (Mac), aby wkleić tekst.

Kliknięcie prawym przyciskiem myszy na zaznaczony tekst w Adobe Reader, aby go skopiować
Kliknij prawym przyciskiem i wybierz kopiuj

Pomiń instalację, jeśli wolisz się nie kłopotać. Przeciągnij plik PDF do karty w przeglądarce Chrome, Edge lub Safari i tam zaznacz tekst, używając tych samych skrótów.

Najlepsze do skopiowania akapitu lub dwóch. Złożone układy stron trafiają do schowka ze zmienionym formatowaniem, a ze skanów PDF nie otrzymasz absolutnie nic.

Metoda 2: Microsoft Word

Word nie kopiuje tekstu, on przebudowuje dokument, co jest powodem, dla którego zachowuje formatowanie, które zostałoby spłaszczone w schowku. Po tę metodę warto sięgnąć, gdy chcesz skopiować tekst z pliku PDF do programu Word.

  1. Otwórz program Word, kliknij "Plik", następnie "Otwórz" i wybierz swój plik PDF.
  2. Kliknij "Otwórz". Word ostrzeże, że zamierza przekonwertować plik. Pozwól na to.
  3. Skopiuj potrzebny tekst z przekonwertowanego dokumentu.

Microsoft Word konwertujący plik PDF
Poczekaj, aż Word przekonwertuje PDF

Proste dokumenty przechodzą ten proces zachowując większość swojego formatowania.

Przekonwertowany plik PDF otwarty jako edytowalny dokument w programie Microsoft Word
Dokument PDF w MS Word

Wielokolumnowe strony i mocno sformatowane raporty to miejsca, w których konwersja staje się kreatywna. Sprawdź je, zanim im zaufasz.

Metoda 3: Dokumenty Google

Dokumenty Google wykonują OCR podczas importu, co sprawia, że jest to najkrótsza droga do tekstu w zeskanowanym pliku PDF. Najpierw prześlij plik na Dysk Google.

Plik PDF przesłany na Dysk Google
Prześlij PDF na Dysk Google

  1. Kliknij prawym przyciskiem myszy na dokument, wybierz "Otwórz za pomocą", a następnie "Dokumenty Google".
  2. Zaznacz potrzebny tekst i wklej go tam, gdzie go potrzebujesz.

Otwieranie pliku PDF za pomocą Dokumentów Google z menu Dysku Google
Otwórz za pomocą Dokumentów Google

Dokumenty odczytują stronę i zwracają edytowalny dokument. Słowa przechodzą prawidłowo. Formatowanie niestety nie, co dobitnie pokazuje poniższy zrzut ekranu.

Plik PDF przekonwertowany na edytowalny Dokument Google
Zaznacz potrzebny tekst

Metoda 4: Internetowe konwertery PDF na tekst

Konwertery zmieniają cały dokument w zwykły tekst w jednym kroku, co jest pożądanym efektem, gdy układ strony nie ma znaczenia. PDF to Text i PDF2Go wykonają to zadanie. Używając PDF2Go:

  1. Prześlij plik metodą "przeciągnij i upuść" albo z Dysku Google lub Dropboxa.

Plik PDF przesyłany do konwertera PDF2Go
Prześlij PDF do pdf2go

  1. Wybierz swoje ustawienia, kliknij "Rozpocznij" i poczekaj na konwersję.
  2. Pobierz plik tekstowy, a następnie skopiuj i wklej to, czego potrzebujesz.

Dwie kwestie do rozważenia przed przesłaniem pliku. Narzędzia te używają tradycyjnego OCR (optycznego rozpoznawania znaków), który odczytuje znaki bez zrozumienia ich znaczenia, więc otrzymujesz tekst, a nie użyteczne dane. Przekazujesz też swój dokument na obcy serwer, co wymaga chwili zastanowienia, gdy plik zawiera wysokość pensji, diagnozę medyczną lub poufną umowę.

Metoda 5: Biblioteki języka Python

Jeśli sprawnie poruszasz się w kodzie, pypdf lub Adobe PDF Services API zrobią to programowo. pypdf to biblioteka open-source w Pythonie służąca do czytania, dzielenia, łączenia i transformacji stron PDF i jest ona regularnie utrzymywanym następcą PyPDF2. API firmy Adobe oferuje podobne możliwości jako usługa płatna.

Jest tylko jeden haczyk. pypdf odczytuje warstwę tekstową, więc w przypadku skanu zwraca pusty ciąg znaków, co może wywołać chwilowy kryzys zaufania. Dla takich plików musisz połączyć tę metodę z krokiem OCR.

Metoda 6: Przechwytywanie tekstu z ekranu

Każdy liczący się system operacyjny potrafi obecnie wydobyć tekst bezpośrednio z ekranu, co jest wyjściem awaryjnym, gdy plik PDF odmawia współpracy.

W systemie Windows 11 otwórz Narzędzie Wycinanie, przechwyć obszar strony i użyj Akcji Tekstowych (Text Actions), aby wyciągnąć słowa. Na komputerze Mac funkcja Live Text (Tekst na żywo) robi to samo na zrzucie ekranu w aplikacji Podgląd. Na iPhonie i systemie Android przytrzymaj palec na tekście znajdującym się na zrzucie ekranu.

To działa na skanach oraz na plikach, w których zaznaczanie jest zablokowane – to potrafi niewiele z wymienionych metod. Jej ograniczeniem jest to, że radzi sobie tylko z tym, co mieści się na jednym ekranie. To narzędzie ratunkowe, a nie rozwiązanie do codziennej pracy.

Dlaczego nie mogę skopiować tekstu z tego PDF-a?

Jeśli w ogóle nie możesz zaznaczyć tekstu w pliku PDF, istnieją tylko dwie prawdopodobne przyczyny, a ich rozróżnienie zajmuje około sekundy.

Twój kursor rysuje ramkę na całej stronie. Plik PDF to skan lub obraz. Nie ma w nim warstwy tekstowej, jedynie zdjęcie tekstu, więc żadne klikanie nie trafi w poszczególne słowa. Potrzebujesz w tym wypadku OCR, który zamieni go w przeszukiwalny plik PDF. Dokumenty Google (Metoda 3 powyżej) to najszybszy sposób na jednorazowe wykonanie tej czynności.

Twój kursor podświetla słowa, ale Ctrl+C nie daje żadnego rezultatu. Kopiowanie jest wyłączone w uprawnieniach pliku. W programie Acrobat Reader kliknij stronę prawym przyciskiem myszy, wybierz Właściwości dokumentu i sprawdź zakładkę Zabezpieczenia, aby dokładnie zobaczyć, na co zezwolił autor. Jeśli kopiowanie treści jest wyłączone, właściwym krokiem jest poproszenie nadawcy o niezabezpieczoną wersję lub hasło. Jeśli dokument jest Twój, po prostu usuń ograniczenie w tym samym panelu.

Kiedy metoda kopiuj-wklej zawodzi

Wszystkie sześć metod ma wspólne ograniczenie, do którego dotrzesz szybciej, niż się spodziewasz.

  • Formatowanie rzadko znosi przesyłanie przez schowek. Czcionki, rozmiary i kolumny traktowane są raczej jako sugestie.
  • Tabele stają się kompletnym chaosem, ponieważ schowek nie ma pojęcia o istnieniu wierszy i kolumn.
  • Tradycyjny OCR jest precyzyjny tylko do momentu, gdy skan nie stanie się krzywy, niewyraźny lub przepełniony treścią.
  • Konwertery internetowe wysyłają Twój dokument na wycieczkę przez czyjś obcy serwer.
  • Jeśli podczas kopiowania pomylisz choćby jedną cyfrę w kwocie końcowej faktury, jesteś w gorszej sytuacji, niż gdybyś w ogóle nie miał danych.
  • I wszystko, co udało Ci się skopiować, nadal musi zostać wpisane lub zaimportowane do systemu, który faktycznie tych danych potrzebuje.

Z żadną z tych rzeczy nie ma problemu przy pojedynczym dokumencie. Mają one jednak ogromne znaczenie w przypadku pięćdziesiątego pliku w tym miesiącu.

Co potrafi odczytać AI, a czego nie potrafi schowek

Ekstrakcja tekstu wspierana przez AI odczytuje dokument w ten sam sposób co człowiek, rozumiejąc znaczenie jego układu, a nie tylko umiejscowienie znaków. Na tym właśnie polega różnica pomiędzy odzyskiwaniem tekstu, a pozyskiwaniem danych, z których można faktycznie skorzystać.

Tradycyjny OCR daje Ci stronę pełną znaków, pozostawiając Ci zadanie znalezienia numeru faktury. Silnik sztucznej inteligencji od razu podaje ten numer.

Dlaczego parser AI radzi sobie z tym lepiej

Parseur potrafi wyodrębnić określony tekst z dokumentów PDF niezależnie od tego, jak skomplikowany jest jego układ.

Utwórz darmowe konto
Oszczędzaj czas i wysiłek z Parseur. Automatyzuj swoje dokumenty.
  • Każdy dostawca inaczej formatuje swoje dokumenty. Ty określasz pola tylko raz, i nikt nie musi tworzyć osobnego szablonu dla każdego nadawcy.
  • Tabele pozostają tabelami. Parseur potrafi wyodrębniać tabele z PDF-ów w formie wierszy i kolumn zamiast luźnego tekstu.
  • Skany są odczytywane "w locie" przez Strefowy OCR, gdy układ pozostaje niezmienny, oraz przez Dynamiczny OCR, gdy tak nie jest.
  • Twoje dokumenty pozostają Twoje. Parseur jest zgodny z RODO i jest w trakcie wdrażania standardu SOC 2 Type II.

Następnie Parseur dostarcza wyodrębnione wyniki do narzędzi, z których już korzystasz, więc nikt nie musi kopiować ich po raz drugi. To jest parsowanie PDF a nie zwykłe kopiowanie i są to dwie różne rzeczy.

Jak skopiować tekst z zeskanowanego pliku PDF za pomocą Parseur

Konfiguracja zajmuje kilka minut i nie wymaga podawania karty kredytowej.

  1. Utwórz skrzynkę odbiorczą i wybierz silnik AI. Silnik Vision AI odczytuje pliki PDF, skany i obrazy. Silnik Text AI odczytuje e-maile i dokumenty tekstowe.

Tworzenie skrzynki odbiorczej Parseur dla przychodzących dokumentów
Stwórz skrzynkę odbiorczą dla swoich dokumentów

  1. Wypisz pola, których potrzebujesz. AI znajdzie je we wszystkich układach bez konieczności tworzenia szablonów.

Określanie pól do wyodrębnienia w Parseur
Wypisz pola, które chcesz wyodrębnić

  1. Wyślij zeskanowany plik PDF mailem, prześlij go z dysku lub użyj API.
  2. Sprawdź, co zostało zwrócone.

Tekst wyodrębniony z zeskanowanego pliku PDF w Parseur
Ekstrakcja tekstu z zeskanowanego PDF

Pracujesz z jednym typem dokumentu? Rozpocznij od dopasowanej skrzynki odbiorczej, a zwrócone pola będą miały już odpowiednie nazwy. Faktury obsługiwane są przez skrzynkę typu "Invoices" (Faktury).

Tworzenie skrzynki odbiorczej dla faktur w Parseur
Stwórz AI skrzynkę do faktur

Dokąd następnie trafiają dane

  1. Pobierz tekst w formacie CSV lub JSON.
  2. Wyślij dane do Arkusza Google.
  3. Eksportuj dane do dowolnej aplikacji korzystając z Zapier, Make lub Power Automate.

Kopiowanie tekstu z jednego pliku PDF zajmuje dwie sekundy. Kopiowanie z następnych pięciuset to praca, której nikt nie powinien dostać. Wypróbuj Parseur na stosie dokumentów, których do tej pory starałeś się unikać.

Opinia klienta Parseur
Opinia zadowolonego klienta

Ostatnia aktualizacja

Idź dalej

Może Cię też zainteresować

Rozpocznij

Zautomatyzuj ekstrakcję danych
z dokumentów już dziś

Załóż konto za darmo w kilka minut i zobacz, jak Parseur wpasowuje się w Twój proces.

Bez trenowania modeli AI
Działa od razu na Twoich dokumentach
Od prostego eksportu po pełne API

Często zadawane pytania

Pytania, które ludzie faktycznie zadają, gdy PDF odmawia współpracy.

Otwórz plik PDF w przeglądarce lub czytniku PDF, przeciągnij kursorem po wybranym tekście, a następnie naciśnij Ctrl+C na systemie Windows lub Cmd+C na komputerze Mac. Wklej używając Ctrl+V lub Cmd+V. Jeśli chcesz skopiować tekst bez oryginalnych czcionek i odstępów, wklej używając Ctrl+Shift+V lub wklej go najpierw do zwykłego edytora tekstu, a następnie skopiuj go stamtąd ponownie.

Zeskanowany plik PDF nie ma tekstu, który można zaznaczyć, więc zanim cokolwiek skopiujesz, musi zostać odczytany przez OCR. Przesłanie pliku na Dysk Google i otwarcie go w Dokumentach Google uruchamia OCR automatycznie i jest najkrótszą drogą dla pojedynczego dokumentu. W przypadku regularnego lub wysokonakładowego przetwarzania, parser AI odczytuje skan i zwraca uporządkowane pola zamiast ściany odzyskanego tekstu.

Nie kopiuj i nie wklejaj. Otwórz plik PDF bezpośrednio w programie Microsoft Word za pomocą Plik -> Otwórz i pozwól programowi Word go przekonwertować. Word odtwarza nagłówki, listy i większość tabel, czego zwykłe wklejenie ze schowka nie potrafi zrobić. Konwersja nie jest idealna w przypadku układów wielokolumnowych lub silnie sformatowanych stron, więc przed zaufaniem sprawdź wszystko, co ma kolumny.

Przestań kopiować i pozwól, aby dokumenty zostały odczytane za Ciebie. Ręczne kopiowanie i wklejanie przestaje mieć sens gdzieś w okolicach dziesiątego pliku i nigdy nie przetrwa jako proces powtarzalny. Zamiast tego odbieraj pliki PDF za pośrednictwem poczty e-mail, przesyłania plików lub API, aby zostały one odczytane automatycznie, a interesujące Cię pola wylądowały w arkuszu kalkulacyjnym lub Twoim własnym systemie. To jest parsowanie PDF a nie kopiowanie, a to właśnie do tego stworzono narzędzia takie jak Parseur.

Są dwa główne powody. Albo PDF to skan lub obraz, więc nie ma warstwy tekstowej do zaznaczenia, albo twórca pliku wyłączył uprawnienia do kopiowania. Możesz je odróżnić w sekundę: jeśli kursor podświetla pojedyncze słowa, warstwa tekstowa istnieje i problem leży w uprawnieniach. Jeśli zamiast tego kursor rysuje ramkę wokół całej strony, jest to obraz i potrzebujesz OCR.

Najpierw sprawdź, czy kopiowanie jest faktycznie zablokowane. W programie Acrobat Reader kliknij dokument prawym przyciskiem myszy, wybierz Właściwości dokumentu i spójrz na zakładkę Zabezpieczenia, aby zobaczyć, jakie uprawnienia nadał autor. Jeśli kopiowanie zawartości nie jest dozwolone, właściwą drogą jest poproszenie nadawcy pliku o niezabezpieczoną kopię lub hasło. Jeśli dokument należy do Ciebie i znasz hasło, możesz go otworzyć w programie Acrobat i usunąć zabezpieczenia z tego samego panelu Właściwości dokumentu.

Tak, zarówno w systemach iOS, jak i Android, o ile plik PDF ma rzeczywistą warstwę tekstową. Otwórz go w Plikach, Książkach lub na Dysku, przytrzymaj słowo, aby rozpocząć zaznaczanie, przeciągnij uchwyty, a następnie wybierz Kopiuj. Jeśli przytrzymanie nie zaznacza niczego, strona jest obrazem i potrzebujesz OCR. W systemie iOS możesz również skierować aparat na wydrukowaną stronę i użyć funkcji Live Text (Tekst na żywo), aby skopiować słowa bezpośrednio.

Parseur robi znacznie więcej niż tylko kopiowanie tekstu. Jego silnik Vision AI odczytuje pliki PDF, skany i obrazy, a silnik Text AI odczytuje e-maile i dokumenty tekstowe, zwracając nazwane pola, takie jak numer faktury, data i kwota całkowita, zamiast bloku surowego tekstu. Podajesz listę potrzebnych Ci pól, a AI znajduje je w różnych układach dokumentów, bez konieczności tworzenia szablonu dla każdego nadawcy z osobna. Parseur jest zgodny z RODO i jest w trakcie wdrażania standardu SOC 2 Type II.