PDF, który się nie otwiera, sprawia wrażenie całkowitej straty, ale zwykle nią nie jest. W przeważającej większości przypadków treść stron nadal tkwi w pliku, nienaruszona i czytelna — zepsuł się natomiast ten drobny fragment wewnętrznej ewidencji, który mówi czytnikowi, gdzie zaczyna się każda strona. Naprawa pliku polega na odbudowaniu tej ewidencji, a nie na odtwarzaniu dokumentu.
Ten przewodnik wyjaśnia, co faktycznie się psuje, jak odróżnić plik możliwy do odzyskania od naprawdę zniszczonego oraz jak naprawić PDF w przeglądarce bez instalowania czegokolwiek.
Co naprawdę psuje się w uszkodzonym pliku PDF
PDF nie jest ciągłym strumieniem tekstu, jakim bywa zwykły plik. To zbiór ponumerowanych obiektów — krojów pisma, obrazów, opisów stron, metadanych — po których, na samym końcu pliku, następuje tablica wyszukiwania zwana tablicą odsyłaczy, czyli xref. Xref zapisuje dokładne przesunięcie bajtowe każdego obiektu. Gdy czytnik otwiera PDF, przeskakuje na koniec, czyta xref i dzięki niej odnajduje stronę pierwszą.
Taka konstrukcja jest szybka, ale ma konkretną słabość: indeks znajduje się na końcu i wskazuje wstecz. Jeśli cokolwiek przesunie położenie obiektów albo jeśli końcówka pliku nigdy nie dotrze, wszystkie przesunięcia w xref stają się błędne naraz. Czytnik szuka strony pierwszej pod bajtem 48 213, znajduje tam coś, co nie jest stroną, i poddaje się. W samej stronie nic nie uległo uszkodzeniu.
- Uszkodzona tablica odsyłaczy. Indeks jest obecny, ale jego przesunięcia przestały odpowiadać rzeczywistości. To zdecydowanie najczęstsza postać uszkodzenia PDF i niemal zawsze da się ją naprawić.
- Obcięty plik. Przesyłanie, pobieranie lub kopiowanie zatrzymało się przedwcześnie, więc ostatnia część pliku — wraz z xref — nigdy nie dotarła. Możliwy do odzyskania do miejsca, w którym plik się urywa.
- Uszkodzone strumienie obiektów. Pojedyncze obiekty zostały zmienione, zwykle przez program, który nieprawidłowo zapisał do pliku. Naprawialne strona po stronie; uszkodzone strony mogą stracić formatowanie.
- Uszkodzone osadzone czcionki. Tekst jest obecny, ale przywoływany krój jest nieczytelny, więc strony wyświetlają się puste albo jako kwadraciki. Zwykle da się to naprawić, podstawiając czcionkę standardową.
- Nieprawidłowy nagłówek. Plik nie zaczyna się od
%PDF-. Często oznacza to, że w rzeczywistości nie jest to PDF albo że coś zostało przed nim dopisane.
Najczęstsze komunikaty o błędach, rozszyfrowane
Komunikat wyświetlany przez czytnik to rozsądna wskazówka, co poszło nie tak. Oto te pojawiające się najczęściej:
| Komunikat o błędzie | Co zwykle oznacza | Do odzyskania? |
|---|---|---|
| „Wystąpił błąd podczas otwierania tego dokumentu. Plik jest uszkodzony i nie udało się go naprawić.” | Własna próba naprawy w Adobe poległa na uszkodzonej xref | Zwykle tak, przy użyciu innego narzędzia |
| „Nie udało się wczytać dokumentu PDF.” | Chrome nie zdołał przetworzyć nagłówka albo xref | Zwykle tak |
| „Plik jest nieobsługiwanego typu albo został uszkodzony.” | Nieprawidłowy lub brakujący nagłówek %PDF- | Czasami — sprawdź, czy to naprawdę PDF |
| „Oczekiwano obiektu dict.” / „Nieprawidłowy numer obiektu.” | Uszkodzony strumień obiektów | Częściowo — nieuszkodzone strony da się odzyskać |
| Otwiera się, ale wszystkie strony są puste | Uszkodzone lub brakujące osadzone czcionki | Zwykle tak |
| Otwiera się, ale urywa się w połowie | Obcięty plik | Tylko do miejsca obcięcia |
| „Ten dokument jest chroniony.” | To wcale nie uszkodzenie: plik jest zaszyfrowany | To nie jest problem naprawy |
Ten ostatni wiersz znaczy więcej, niż się wydaje. Niemała część plików przynoszonych do narzędzia naprawczego wcale nie jest uszkodzona — są zabezpieczone hasłem, a komunikat czytnika jest po prostu niejasny. Jeśli znasz hasło, użyj narzędzia Zabezpiecz PDF, aby zarządzać szyfrowaniem pliku, zamiast próbować go naprawiać.
Co da się odzyskać, a czego nie
Uczciwe wyznaczenie oczekiwań jest tu warte więcej niż optymizm, bo podpowiada, kiedy przestać tracić czas na plik i pójść szukać oryginału.
- Prawie zawsze do odzyskania: uszkodzone tablice xref, pliki, których czytnik odmawia otwarcia, choć poza tym są kompletne, PDF-y zapisane przez program, który zawiesił się w trakcie zapisu, oraz pliki wyświetlające się pusto z powodu problemów z czcionkami.
- Częściowo do odzyskania: pliki obcięte. Dostajesz wszystko do bajtu, na którym plik się urywa, i nic po nim. Pobieranie, które doszło do 80%, zwykle daje mniej więcej 80% stron, nienaruszonych.
- Rzadko do odzyskania: pliki, w których same strumienie obiektów zostały nadpisane niepowiązanymi danymi, na przykład przez wadliwy dysk albo umierającą kartę pamięci. Indeks da się odbudować, ale będzie wskazywał treść, której naprawdę już nie ma.
- To w ogóle nie problem naprawy: pliki zaszyfrowane, pliki, które nigdy nie były PDF-ami (na przykład rozszerzenie
.pdfna dokumencie Worda) oraz pliki o rozmiarze 0 bajtów. W pliku zerobajtowym nie ma czego odzyskiwać.
Trzy rzeczy do sprawdzenia przed naprawą
Każda zajmuje mniej niż minutę i każda rozwiązuje realną kategorię problemu, który nie jest uszkodzeniem:
- Otwórz plik w innym czytniku. Czytniki ogromnie różnią się tolerancją wobec plików niezgodnych ze specyfikacją. PDF, który Adobe Acrobat odrzuca bez dyskusji, często otworzy się w Chrome lub Firefoksie, które po cichu naprawiają drobne problemy strukturalne. Jeśli otworzy się w przeglądarce, wydrukuj go ponownie do PDF i masz czystą kopię.
- Pobierz go jeszcze raz. Jeśli plik dotarł przez sieć, najprostszym wyjaśnieniem jest nieudany transfer. Pobierz ponownie i porównaj rozmiar ze źródłem, zanim uznasz, że winny jest sam plik.
- Sprawdź, czy to na pewno PDF. Otwórz go w dowolnym edytorze zwykłego tekstu i spójrz na pierwszy wiersz. Prawdziwy PDF zaczyna się od
%PDF-1.4lub podobnie. Jeśli widziszPK, to ZIP albo plik Office z niewłaściwym rozszerzeniem; jeśli widzisz<!DOCTYPE html>, pobrałeś stronę błędu zamiast dokumentu.
Naprawa pliku PDF w trzech krokach
Jeśli plik jest faktycznie uszkodzony, naprawa w PdfDocShift zajmuje trzy kroki. Bez instalacji i bez rejestracji, a każdy przesłany plik jest trwale usuwany z naszych serwerów po dwóch godzinach.
Otwórz narzędzie Napraw PDF
Wejdź na pdfdocshift.com/repair-pdf i przeciągnij uszkodzony plik na pole wysyłania albo kliknij, aby go wskazać. Prześlij plik dokładnie w takiej postaci, w jakiej jest: nie zmieniaj nazwy, nie zapisuj go ponownie ani nie otwieraj i nie eksportuj wcześniej, bo każda z tych czynności może nadpisać strukturę możliwą jeszcze do odzyskania.
Pozwól przebiec procesowi naprawy
Narzędzie przeszukuje cały plik w poszukiwaniu prawidłowych obiektów PDF, zamiast ufać istniejącemu indeksowi, odbudowuje drzewo stron z tego, co znajdzie, tworzy na nowo tablicę odsyłaczy i podstawia standardowe kroje w miejsce każdej osadzonej czcionki, której nie da się odczytać. Większość plików kończy się w kilka sekund; bardzo duże lub mocno uszkodzone trwają dłużej.
Pobierz i sprawdź
Pobierz naprawiony plik i sprawdź go porządnie — nie tylko stronę pierwszą. Potwierdź, że liczba stron zgadza się z oczekiwaniami, a potem wyrywkowo obejrzyj stronę ze środka i ostatnią. Jeśli brakuje stron, plik był obcięty, a to, co masz, jest wszystkim, co przetrwało.
Napraw uszkodzony PDF już teraz
Bezpłatnie, bez rejestracji, pliki usuwane po 2 godzinach. Większość naprawia się w mniej niż 10 sekund.
Otwórz Napraw PDF →Naprawa skanów i plików pełnych obrazów
Dokumenty skanowane psują się inaczej niż tekstowe i warto traktować je jako osobny przypadek. Skanowany PDF to pojemnik na duże obrazy, więc znacznie większa część pliku to dane obrazu. Oznacza to, że obcięcie kosztuje całe strony zamiast uszkodzonego indeksu, a niekompletny plik często kończy się w środku obrazu, zostawiając ostatnią stronę narysowaną do połowy.
Wynikają z tego dwie rzeczy. Po pierwsze: napraw skanowany PDF zanim zrobisz z nim cokolwiek innego; zastosowanie kompresji lub konwersji do uszkodzonego skanu zwykle utrwala uszkodzenie na dobre. Po drugie: jeśli naprawiony plik otwiera się, ale tekstu nie da się już zaznaczyć, warstwa tekstowa nie przetrwała — możesz ją odtworzyć, przepuszczając naprawiony plik przez OCR PDF, które odczytuje obrazy i zapisuje pod nimi świeżą, przeszukiwalną warstwę tekstu.
Jeśli odzyskany skan okaże się potem nieporęczny — naprawa czasem daje plik większy niż oryginał, bo nie może ponownie wykorzystać uszkodzonych struktur kompresji — Kompresuj PDF sprowadzi go z powrotem do rozsądnego rozmiaru, nie ruszając samych stron.
Jak dochodzi do uszkodzeń PDF i jak im zapobiegać
Niemal wszystkie realne uszkodzenia PDF sprowadzają się do niewielkiej liczby przyczyn, a większości z nich da się uniknąć:
- Przerwane transfery. Zerwane pobieranie, udział sieciowy rozłączający się w połowie kopiowania albo pendrive wyciągnięty przed zakończeniem zapisu. Zawsze poprawnie wysuwaj nośniki wymienne i sprawdzaj rozmiar plików po dużych transferach.
- Edytowanie pliku w chmurze podczas synchronizacji. Zapisanie na PDF-ie, który Dropbox, OneDrive albo Dysk Google właśnie wysyła, to niezawodny sposób na plik w połowie stary, a w połowie nowy. Poczekaj, aż synchronizacja się zakończy, zanim otworzysz plik.
- Programy zawieszające się podczas zapisu. PDF zapisany przez program, który nieoczekiwanie się zamknął, ma zwykle treść, ale nie ma prawidłowego indeksu — to klasyczny przypadek nadający się do naprawy.
- Wysyłanie PDF jako załączników osadzonych przez stare serwery. Niektóre wiekowe systemy pocztowe wciąż stosują kodowanie tekstowe do załączników binarnych, co uszkadza je w drodze. Spakuj plik przed wysłaniem, jeśli masz do czynienia z systemem, któremu nie ufasz.
- Wadliwy nośnik. Uszkodzone sektory i umierające karty pamięci psują pliki po cichu. Jeśli na jednym nośniku popsuł się więcej niż jeden plik, problemem jest nośnik — skopiuj z niego wszystko, zanim zrobisz cokolwiek innego.
Najczęściej zadawane pytania
Nie, ale większość tak. Uszkodzone tablice odsyłaczy — zdecydowanie najczęstsza przyczyna tego, że PDF się nie otwiera — są niemal zawsze naprawialne, ponieważ treść stron pozostaje nietknięta i odbudować trzeba wyłącznie indeks. Pliki obcięte odzyskuje się do miejsca, w którym się urywają. Plików, których rzeczywista treść została nadpisana wskutek awarii dysku, zwykle nie da się odzyskać, a pliku o rozmiarze 0 bajtów nie odzyska żadne narzędzie.
Nie powinna. Naprawa odbudowuje indeks strukturalny i drzewo stron pliku; treść stron jest kopiowana bez zmian. Jedyny wyjątek to osadzone czcionki: jeśli krój jest nieczytelny, naprawa podstawia czcionkę standardową, co może nieznacznie zmienić odstępy lub układ tekstu na stronie. Same słowa pozostają nienaruszone.
Przeglądarki są znacznie bardziej tolerancyjne wobec niepoprawnych PDF-ów niż Acrobat. Chrome i Firefox po cichu obchodzą uszkodzoną tablicę odsyłaczy, przeszukując plik w poszukiwaniu stron, podczas gdy Acrobat sprawdza strukturę i odrzuca pliki, które tego nie przechodzą. To użyteczny sygnał: jeśli plik otwiera się w przeglądarce, treść jest nienaruszona i naprawa niemal na pewno się powiedzie.
Zwykle jest to problem z czcionkami, a nie uszkodzenie stron. Treść strony jest obecna, ale odwołuje się do osadzonego kroju, którego czytnik nie potrafi zdekodować, więc nic się nie rysuje. Przebieg naprawy podstawiający czcionki standardowe zazwyczaj przywraca widoczny tekst. Jeśli strony nadal pozostają puste, dokument może faktycznie zawierać puste strony — sprawdź narzędziem Usuń puste strony, ile stron rzeczywiście ma treść.
Jest bezpiecznie, gdy narzędzie szyfruje przesyłanie i szybko usuwa pliki. PdfDocShift stosuje 256-bitowe SSL przy każdym przesłaniu i trwale usuwa każdy plik ze swoich serwerów po dwóch godzinach. W przypadku szczególnie wrażliwych materiałów napraw plik, a następnie dodaj do niego hasło narzędziem Zabezpiecz PDF, które stosuje szyfrowanie AES 256-bit, zanim go udostępnisz.
Nie. Naprawa i odszyfrowanie to całkowicie różne operacje. Narzędzie naprawcze odbudowuje strukturę uszkodzonego pliku; nie usuwa ani nie odtwarza szyfrowania. Jeśli PDF otwiera się prośbą o hasło, a nie komunikatem o błędzie, plik nie jest uszkodzony — jest chroniony i będziesz potrzebować hasła.
Gotowy, aby odzyskać swój plik?
Bezpłatnie, bez rejestracji, pliki usuwane po 2 godzinach. Działa na każdym urządzeniu, bez instalacji.
Otwórz Napraw PDF →