Um PDF que não abre parece uma perda total, mas normalmente não é. Na esmagadora maioria dos casos o conteúdo das páginas continua dentro do ficheiro, intacto e legível — o que se partiu foi aquela pequena peça de contabilidade interna que diz ao leitor onde começa cada página. Reparar o ficheiro é reconstruir essa contabilidade, não recriar o documento.
Este guia explica o que se parte de facto, como distinguir um ficheiro recuperável de um verdadeiramente destruído e como reparar um PDF no seu navegador sem instalar nada.
O que se parte realmente num PDF danificado
Um PDF não é um fluxo contínuo de texto como é um ficheiro simples. É uma coleção de objetos numerados — tipos de letra, imagens, descrições de página, metadados — seguida, mesmo no fim do ficheiro, de uma tabela de consulta chamada tabela de referências cruzadas, ou xref. A xref regista o deslocamento exato em bytes de cada objeto. Quando um leitor abre um PDF, salta para o fim, lê a xref e usa-a para encontrar a página um.
Esse desenho é rápido, mas tem uma fragilidade concreta: o índice vive no fim e aponta para trás. Se algo deslocar a posição dos objetos, ou se a cauda do ficheiro nunca chegar, todos os deslocamentos da xref ficam errados de uma só vez. O leitor procura a página um no byte 48 213, encontra algo que não é uma página e desiste. Nada na página em si foi danificado.
- Tabela de referências cruzadas partida. O índice está presente mas os seus deslocamentos já não correspondem à realidade. É de longe a forma mais comum de dano num PDF e é quase sempre reparável.
- Ficheiro truncado. Um carregamento, uma transferência ou uma cópia parou antes do tempo, pelo que a última parte do ficheiro — incluindo a xref — nunca chegou. Recuperável até ao ponto onde o ficheiro termina.
- Fluxos de objetos danificados. Objetos individuais foram alterados, normalmente por um programa que escreveu mal no ficheiro. Reparável página a página; as páginas danificadas podem perder a formatação.
- Tipos de letra incorporados corrompidos. O texto está presente mas a fonte que ele referencia está ilegível, pelo que as páginas surgem em branco ou com quadrados. Costuma resolver-se substituindo por uma fonte padrão.
- Cabeçalho inválido. O ficheiro não começa por
%PDF-. Muitas vezes significa que não é mesmo um PDF, ou que algo lhe foi anteposto.
As mensagens de erro mais comuns, descodificadas
A mensagem que o seu leitor mostra é um bom indicador do que correu mal. Estas são as que surgem com mais frequência:
| Mensagem de erro | O que costuma significar | Recuperável? |
|---|---|---|
| «Ocorreu um erro ao abrir este documento. O ficheiro está danificado e não foi possível repará-lo.» | A própria tentativa de reparação da Adobe falhou perante uma xref partida | Normalmente sim, com outra ferramenta |
| «Não foi possível carregar o documento PDF.» | O Chrome não conseguiu interpretar o cabeçalho ou a xref | Normalmente sim |
| «O ficheiro não é de um tipo suportado ou está danificado.» | Cabeçalho %PDF- em falta ou inválido | Às vezes — confirme que é mesmo um PDF |
| «Esperado um objeto dict.» / «Número de objeto inválido.» | Fluxo de objetos danificado | Parcialmente — as páginas intactas recuperam-se |
| Abre, mas todas as páginas estão em branco | Tipos de letra incorporados corrompidos ou em falta | Normalmente sim |
| Abre, mas interrompe-se a meio | Ficheiro truncado | Apenas até ao ponto de corte |
| «Este documento está protegido.» | Não é dano nenhum: está cifrado | Não é um problema de reparação |
Aquela última linha conta mais do que parece. Uma parte nada despicienda dos ficheiros que as pessoas levam a uma ferramenta de reparação não está danificada: está protegida por palavra-passe, e a mensagem do leitor é apenas pouco clara. Se souber a palavra-passe, use Proteger PDF para gerir a cifragem do ficheiro em vez de tentar repará-lo.
O que se pode recuperar e o que não
Definir expectativas honestas vale mais do que otimismo, porque lhe diz quando parar de gastar tempo num ficheiro e ir à procura do original.
- Quase sempre recuperável: tabelas xref partidas, ficheiros que um leitor se recusa a abrir mas que de resto estão completos, PDF gravados por um programa que fechou a meio da escrita e ficheiros que aparecem em branco por problemas de fontes.
- Parcialmente recuperável: ficheiros truncados. Fica com tudo até ao byte onde o ficheiro termina, e com nada depois disso. Uma transferência que chegou aos 80% costuma dar cerca de 80% das páginas, intactas.
- Raramente recuperável: ficheiros em que os próprios fluxos de objetos foram sobrescritos com dados alheios, por exemplo por um disco avariado ou um cartão de memória em fim de vida. O índice pode ser reconstruído, mas apontará para conteúdo que desapareceu mesmo.
- Não é sequer um problema de reparação: ficheiros cifrados, ficheiros que nunca foram PDF (uma extensão
.pdfnum documento Word, por exemplo) e ficheiros de 0 bytes. Dentro de um ficheiro de 0 bytes não há nada para recuperar.
Três coisas a tentar antes de reparar
Cada uma demora menos de um minuto e cada uma resolve uma categoria real de problema que não é corrupção:
- Abra-o noutro leitor. Os leitores variam enormemente na tolerância a ficheiros malformados. Um PDF que o Adobe Acrobat rejeita liminarmente abre muitas vezes no Chrome ou no Firefox, que corrigem em silêncio pequenos problemas estruturais. Se abrir no navegador, volte a imprimi-lo para PDF e fica com uma cópia limpa.
- Transfira-o outra vez. Se o ficheiro chegou pela rede, a explicação mais simples é que a transferência falhou. Volte a transferi-lo e compare o tamanho com o da origem antes de assumir que a culpa é do ficheiro.
- Confirme que é um PDF. Abra-o em qualquer editor de texto simples e olhe para a primeira linha. Um PDF verdadeiro começa por
%PDF-1.4ou semelhante. Se virPK, é um ZIP ou um ficheiro do Office com a extensão errada; se vir<!DOCTYPE html>, transferiu uma página de erro em vez do documento.
Reparar um PDF em três passos
Se o ficheiro estiver mesmo danificado, repará-lo com o PdfDocShift leva três passos. Sem instalação e sem registo, e todos os ficheiros carregados são eliminados definitivamente dos nossos servidores ao fim de duas horas.
Abra a ferramenta Reparar PDF
Vá a pdfdocshift.com/repair-pdf e arraste o ficheiro danificado para a área de carregamento, ou clique para o procurar. Carregue o ficheiro exatamente como está: não lhe mude o nome, não volte a gravá-lo nem o abra e reexporte antes, porque qualquer uma dessas ações pode sobrescrever estrutura ainda recuperável.
Deixe correr a passagem de reparação
A ferramenta percorre o ficheiro inteiro à procura de objetos PDF válidos em vez de confiar no índice existente, reconstrói a árvore de páginas a partir do que encontra, refaz a tabela de referências cruzadas e substitui por fontes padrão qualquer tipo de letra incorporado que não consiga ler. A maioria dos ficheiros fica pronta em segundos; os muito grandes ou muito danificados demoram mais.
Transfira e verifique
Transfira o ficheiro reparado e verifique-o a sério, não apenas a página um. Confirme que o número de páginas corresponde ao esperado e depois veja por amostragem uma página do meio e a última. Se faltarem páginas, o ficheiro estava truncado e o que tem é tudo o que sobreviveu.
Repare já um PDF danificado
Grátis, sem registo, ficheiros eliminados ao fim de 2 horas. A maioria é reparada em menos de 10 segundos.
Abrir Reparar PDF →Reparar PDF digitalizados e com muitas imagens
Os documentos digitalizados danificam-se de forma diferente dos de texto, e vale a pena tratá-los como um caso próprio. Um PDF digitalizado é um contentor de imagens grandes, pelo que uma fatia muito maior do ficheiro são dados de imagem: isso significa que o truncamento lhe custa páginas inteiras em vez de um índice partido, e que um ficheiro parcial termina muitas vezes a meio de uma imagem, deixando uma última página desenhada pela metade.
Daqui decorrem duas coisas. Primeira: repare um PDF digitalizado antes de lhe fazer seja o que for; aplicar compressão ou conversão a uma digitalização danificada tende a fixar o dano de forma permanente. Segunda: se o ficheiro reparado abrir mas o texto já não puder ser selecionado, a camada de texto não sobreviveu — pode reconstruí-la passando o ficheiro reparado por OCR PDF, que lê as imagens e escreve por baixo uma nova camada de texto pesquisável.
Se a digitalização recuperada ficar depois pesada — a reparação produz por vezes um ficheiro maior do que o original, porque não consegue reaproveitar as estruturas de compressão partidas —, Comprimir PDF trá-la-á de novo para baixo sem tocar nas páginas em si.
Como os PDF se danificam e como evitá-lo
Quase toda a corrupção real de PDF se reconduz a um número reduzido de causas, e a maioria é evitável:
- Transferências interrompidas. Uma transferência que cai, uma partilha de rede que se desliga a meio da cópia, ou uma pen USB retirada antes de a escrita terminar. Ejete sempre os suportes amovíveis em condições e verifique o tamanho dos ficheiros após transferências grandes.
- Editar um ficheiro na nuvem enquanto sincroniza. Gravar por cima de um PDF que o Dropbox, o OneDrive ou o Google Drive está precisamente a carregar é uma forma fiável de produzir um ficheiro meio antigo e meio novo. Deixe a sincronização terminar antes de abrir o ficheiro.
- Aplicações que fecham durante a gravação. Um PDF escrito por um programa que terminou de forma inesperada tem tipicamente conteúdo mas nenhum índice válido — o caso reparável clássico.
- Enviar PDF como anexos incorporados através de servidores antigos. Alguns sistemas de correio mais antigos ainda aplicam codificação em modo de texto a anexos binários, corrompendo-os em trânsito. Comprima o ficheiro antes de enviar se estiver a lidar com um sistema em que não confia.
- Armazenamento a falhar. Setores defeituosos e cartões de memória em fim de vida corrompem ficheiros em silêncio. Se mais do que um ficheiro de uma unidade se estragou, o problema é a unidade — copie tudo para fora antes de fazer qualquer outra coisa.
Perguntas frequentes
Não, mas a maioria pode. As tabelas de referências cruzadas partidas — de longe a causa mais comum de um PDF que não abre — são quase sempre reparáveis, porque o conteúdo das páginas está intacto e só é preciso reconstruir o índice. Os ficheiros truncados recuperam-se até ao ponto em que terminam. Os ficheiros cujo conteúdo efetivo foi sobrescrito por uma falha de disco em geral não se recuperam, e nenhuma ferramenta consegue recuperar um ficheiro de 0 bytes.
Não deve. Uma reparação reconstrói o índice estrutural e a árvore de páginas do ficheiro; o conteúdo das páginas é copiado sem alterações. A única exceção são os tipos de letra incorporados: se uma fonte estiver ilegível, a reparação substitui-a por uma padrão, o que pode alterar ligeiramente o espaçamento ou a disposição do texto na página. As palavras em si não são afetadas.
Os navegadores são bastante mais tolerantes com PDF malformados do que o Acrobat. O Chrome e o Firefox contornam em silêncio uma tabela de referências cruzadas partida percorrendo o ficheiro à procura de páginas, ao passo que o Acrobat valida a estrutura e recusa os ficheiros que não passam. É um sinal útil: se abre no navegador, o conteúdo está intacto e uma reparação irá quase de certeza resultar.
Normalmente é um problema de tipos de letra e não um dano nas páginas. O conteúdo da página está presente mas referencia uma fonte incorporada que o leitor não consegue descodificar, pelo que nada é desenhado. Uma passagem de reparação que substitua por fontes padrão costuma repor o texto visível. Se as páginas continuarem em branco, o documento pode conter mesmo páginas vazias — experimente Remover páginas em branco para confirmar quantas páginas têm conteúdo.
É seguro quando a ferramenta cifra os carregamentos em trânsito e elimina os ficheiros com rapidez. O PdfDocShift usa SSL de 256 bits em cada carregamento e elimina definitivamente cada ficheiro dos seus servidores ao fim de duas horas. Para material especialmente sensível, repare o ficheiro e depois acrescente-lhe uma palavra-passe com a ferramenta Proteger PDF, que aplica cifragem AES de 256 bits, antes de o partilhar.
Não. Reparação e decifragem são operações completamente distintas. Uma ferramenta de reparação reconstrói a estrutura de um ficheiro danificado; não remove nem recupera a cifragem. Se um PDF abrir com um pedido de palavra-passe em vez de uma mensagem de erro, o ficheiro não está danificado — está protegido, e vai precisar da palavra-passe.
Pronto para recuperar o seu ficheiro?
Grátis, sem registo, ficheiros eliminados ao fim de 2 horas. Funciona em qualquer dispositivo, sem instalação.
Abrir Reparar PDF →