Napraw PDF

Niektóre PDF-y psują się w drodze. Inne przy wysyłaniu. Jeszcze inne w archiwum.
Ratujemy, co się da — i uczciwie mówimy, czego nie udało się uratować.

Upuść tutaj uszkodzony PDF do naprawy
Pliki do 40 MB · Za darmo · Do 40 MB · Przetwarzane w Twojej przeglądarce

O naprawie plików PDF

Jak zwykle psują się PDF-y

Obcięcie w transporcie pocztowym to najczęstsza przyczyna: serwery SMTP ucinają duże załączniki w połowie pliku, pozostawiając PDF bez końcowych bajtów. Przerwania sieci podczas pobierania dają ten sam efekt. Błędy firmware'u skanerów (Xerox, Canon, HP) zapisują wadliwe tablice xref — dokument jest strukturalnie nieprawidłowy, ale treść stron pozostaje nienaruszona. Archiwalne PDF-y z lat 1998-2003 używały nagłówków sprzed doprecyzowania specyfikacji, które rygorystyczne parsery dziś odrzucają. Zaskakująco częste są PDF-y, do których system pocztowy dokleił śmieci. Każda z tych klas ma swoją ścieżkę odzyskiwania; narzędzie mówi, która zadziałała i jak kompletny jest wynik.

Co da się naprawić

Tolerancyjny tryb pdf-lib obsługuje natywnie pięć klas uszkodzeń: śmieci między obiektami pośrednimi, brakujące sekcje odsyłaczy xref, brakujące słowniki trailer, uszkodzone odwołania Root w katalogu (narzędzie ponownie przeszukuje dokument w poszukiwaniu prawidłowego katalogu) oraz nieprawidłowe obiekty pośrednie (narzędzie je pomija i kontynuuje). Gdy brakuje sygnatury nagłówka PDF, narzędzie przeszukuje pierwsze 1024 bajty w poszukiwaniu osadzonej sygnatury i wznawia wczytywanie od tego miejsca. Nietypowe struktury ze starego firmware'u skanerów często wczytują się bez problemu, bo tryb tolerancyjny jest celowo pobłażliwy.

Czego nie naprawimy

Zaszyfrowanych PDF-ów bez hasła nie da się naprawić — treść pliku jest zaszyfrowana razem ze strukturalnymi metadanymi. Najpierw usuń hasło w swoim programie do PDF, a potem wgraj plik. Pliki, które w ogóle nie są PDF-ami (np. pliki tekstowe lub obrazy przemianowane na .pdf), są wykrywane na wstępie przez sprawdzenie bajtów magicznych %PDF. Plików, przy których parser zatrzymuje się całkowicie (zwykle przy dużym obcięciu z utratą ponad 50% bajtów), nie da się uratować strukturalnie. Przy całkowitej utracie PDF na tekst może jeszcze w ostateczności wydobyć zawartość tekstową.

Trzy stopnie wyniku — wyjaśnienie

W pełni naprawiony oznacza, że pdf-lib wczytał dokument bez ani jednego ostrzeżenia parsera — wynik powinien wyświetlać się jak nieuszkodzony PDF. Częściowo odzyskany oznacza, że pdf-lib zgłosił przy wczytywaniu co najmniej jedno ostrzeżenie (pominięte nieprawidłowe obiekty, przekierowane uszkodzone odwołania) — wynik nadaje się do użytku, ale część obiektów mogła przepaść; lista ostrzeżeń pokazuje które. Odzyskana tylko struktura oznacza, że narzędzie musiało przed wczytaniem odtworzyć brakujący nagłówek — struktura pliku jest prawidłowa, ale wyświetlanie treści jest niepewne; jeśli treść nie renderuje się poprawnie, rozważ PDF na tekst. Po każdym pomyślnym wyniku Kompresuj PDF może pomóc, jeśli przed udostępnieniem liczy się rozmiar.

Dlaczego naprawa wyłącznie w przeglądarce ma znaczenie

Uszkodzone PDF-y często zawierają dokładnie to, co najbardziej chcesz odzyskać — wyciągi bankowe obcięte w trakcie przesyłania, projekty prawne ze skanera, który zawiódł, dokumenty archiwalne z dawno wyłączonego systemu. Wysyłanie ich na cudzy serwer akurat wtedy, gdy nie możesz ich otworzyć, zwiększa ryzyko: nie wiesz, co kryje się w uszkodzonych bajtach — serwer też nie. Naprawa w pdfmundo działa w całości w Twojej przeglądarce dzięki pdf-lib. Uszkodzony plik nigdy nie opuszcza Twojego urządzenia. Konkurencyjne narzędzia albo wysyłają pliki na serwery (Sejda, PDF24), albo chowają funkcję za abonamentem (PDFCandy, Adobe). pdfmundo daje ją za darmo, bez limitów, wyłącznie w przeglądarce.

Najczęstsze pytania

Jakie rodzaje uszkodzeń da się naprawić?
Tolerancyjny tryb pdf-lib obejmuje natywnie pięć klas uszkodzeń: śmieci między obiektami pośrednimi, brakujące sekcje xref, brakujące słowniki trailer, uszkodzone odwołania do katalogu i nieprawidłowe obiekty pośrednie. Narzędzie dokłada dwie ścieżki: wstępne wykrywanie plików niebędących PDF-ami oraz ponowną próbę z odtworzonym nagłówkiem, przeszukującą pierwsze 1024 bajty w poszukiwaniu przesuniętej sygnatury PDF. Plików z szyfrowaniem, którego nie możesz zdjąć, albo z całkowicie zniszczoną treścią nie da się naprawić.
Czy naprawa spowoduje utratę treści?
<strong>W pełni naprawiony</strong> oznacza brak utraty treści — wynik wyświetla się jak nieuszkodzony PDF. <strong>Częściowo odzyskany</strong> oznacza, że przy wczytywaniu odrzucono część nieprawidłowych obiektów — zwykle osadzone czcionki lub obrazy, których pdf-lib nie zdołał zdekodować. Tekst stron zazwyczaj się zachowuje. <strong>Odzyskana tylko struktura</strong> oznacza, że narzędzie odtworzyło przed wczytaniem brakujący nagłówek — wyświetlanie treści jest niepewne. Lista ostrzeżeń w panelu wyników pokazuje dokładnie, których obiektów to dotyczyło.
Dlaczego nie da się naprawić zaszyfrowanych PDF-ów?
Szyfrowanie nakłada się na strukturę dokumentu. Bez hasła słownik Info i strumienie treści są nieczytelne — łącznie ze strukturalnymi metadanymi, których narzędzie potrzebuje do podjęcia próby odzyskania. Najpierw usuń hasło w swoim programie do PDF (jeśli je znasz), a potem wróć tutaj.
Co oznacza „częściowo odzyskany”?
pdf-lib zgłosił przy wczytywaniu co najmniej jedno ostrzeżenie parsera — zwykle że konkretnego obiektu pośredniego nie dało się odczytać (i został pominięty) albo że uszkodzone odwołanie przekierowano na inny cel. Wynikowy PDF nadaje się do użytku, ale część obiektów może brakować. Lista ostrzeżeń w panelu wyników wymienia każde zgłoszone ostrzeżenie, żebyś mógł sprawdzić, czego to dotyczyło.
Czy mój uszkodzony plik trafia na wasze serwery?
Nie. Naprawa działa w całości w Twojej przeglądarce. Uszkodzony plik zostaje na Twoim urządzeniu. Akurat tutaj ma to szczególne znaczenie: uszkodzone PDF-y często zawierają to, o co najbardziej się martwisz, a konkurencyjne narzędzia albo wysyłają pliki na serwery, albo chowają funkcję za abonamentem. pdfmundo daje ją za darmo, bez limitów, wyłącznie w przeglądarce.
Co, jeśli naprawiony plik nadal się nie otwiera?
Niektóre PDF-y są uszkodzone bardziej, niż potrafi naprawić przeglądarka. Jeśli naprawiony plik nadal się nie otwiera: spróbuj innego czytnika (Adobe Reader, Podgląd, wbudowana przeglądarka w Firefoksie) albo użyj <a href='/pl/pdf-to-text/'>PDF na tekst</a> jako ostatniej deski ratunku. To narzędzie czyta na innym poziomie abstrakcji i potrafi odzyskać czysty tekst nawet wtedy, gdy pełne renderowanie PDF-a zawodzi.
Jak duży plik mogę naprawić?
Do 40 MB. Przy uszkodzonych plikach większych niż 40 MB ogranicza nas pamięć przeglądarki: koszt analizy w pdf-lib rośnie wraz z rozmiarem pliku, a wbudowany silnik powyżej tego limitu przestaje być niezawodny.
Czym różni się „w pełni naprawiony” od „częściowo odzyskanego”?
W pełni naprawiony oznacza zero ostrzeżeń pdf-lib podczas wczytywania. Częściowo odzyskany oznacza, że pojawiło się co najmniej jedno ostrzeżenie — parser natrafił na coś, czego nie mógł w pełni obsłużyć, i to ominął. Oba dają PDF nadający się do użytku; „częściowo odzyskany” sygnalizuje tylko, że warto sprawdzić, czy treść odpowiada Twoim oczekiwaniom. Lista ostrzeżeń pokazuje, czego konkretnie to dotyczyło.

Więcej narzędzi PDF już wkrótce

Łącznie 29 narzędzi — łączenie, dzielenie, konwersja, OCR, podpisywanie, znaki wodne i więcej. Wszystkie za darmo do wypróbowania.

Powrót na stronę główną →