Um fluxo de trabalho do scanner ao PDF tem quatro passos: transforme as imagens em um PDF, extraia o texto para que ele se torne pesquisável, organize a ordem e a rotação das páginas, depois bloqueie o arquivo com uma senha. Cada um desses passos pode rodar no navegador, então um documento sensível nunca precisa sair da máquina em que foi digitalizado.
O valor de fazer isso em um só lugar é que nada é entregue a um desconhecido no meio do caminho. Um passaporte digitalizado, um contrato assinado ou um formulário médico é exatamente o arquivo que os conversores em nuvem mantêm pelo tempo que sua política permitir, e é exatamente o arquivo que você não deve enviar. Este fluxo de trabalho usa quatro ferramentas de navegador separadas, e o arquivo se move entre elas através da sua própria pasta de downloads, e não através de um servidor. Cada passo abaixo declara o que faz, o que configurar e onde a ferramenta para de funcionar, para você decidir até onde levar.
A maioria das pessoas resolve isso com um aplicativo de scanner que envia para um drive na nuvem, ou um site de conversão que devolve um PDF após uma ida e volta. Ambos funcionam até o documento ser um que você não tem permissão para enviar a lugar algum: um acordo assinado, uma carta de benefícios, uma página de resultados médicos. Os quatro passos abaixo fazem o mesmo trabalho com o arquivo nunca saindo do seu dispositivo.
Imagem para PDF
Passo um do fluxo de trabalho. Combine digitalizações JPG, PNG, WebP, AVIF, GIF e BMP em um único PDF, com tamanho de página, orientação e margens sob o seu controle.
Por que manter todo o fluxo de trabalho na sua máquina
A razão para se importar não é abstrata. Um conversor em nuvem precisa receber o seu arquivo, mantê-lo por algum período e decidir quando excluí-lo. Para uma conta de serviços públicos isso é indiferente; para um documento de identidade, um contrato ou um prontuário médico, é uma cópia que você nunca pretendia criar.
| Este fluxo de trabalho | Conversor com upload | |
|---|---|---|
| Para onde vai a digitalização | Fica no seu dispositivo | Enviado para os servidores deles |
| Como o arquivo se move entre os passos | A sua pasta de downloads | O armazenamento de sessão deles |
| Retenção | Você decide | A política deles |
| Conta | Não necessário | Geralmente obrigatório |
| Funciona offline | Após o primeiro carregamento do mecanismo | Não |
Tudo abaixo pressupõe um Chrome, Edge, Firefox ou Safari atual, já que o fluxo de trabalho precisa das APIs modernas Canvas, WebAssembly e File. Os mecanismos são baixados uma vez e ficam em cache, então uma segunda execução de um passo é mais rápida.
Passo 1: transforme as digitalizações em um PDF
O imagem para PDF ferramenta aceita arquivos JPG, PNG, WebP, AVIF, GIF e BMP e grava um PDF com uma página por imagem. JPG e PNG são incorporados como estão; os outros formatos são decodificados por um canvas primeiro, o que os mantém funcionando sem um servidor.
- Adicione as imagens das páginas. Solte as digitalizações na ordem em que estão. Arraste os cartões, ou use as setas para cima e para baixo em cada cartão, para corrigir a ordem antes de exportar.
- Defina a geometria da página. Escolha A4 ou Letter, depois escolha Automático, Retrato ou Paisagem e uma margem de Nenhuma, Pequena, Média ou Grande. Escolha Conter para ajustar toda a digitalização dentro da margem, ou Cobrir para preencher a página e deixar o leitor recortar o excesso.
- Nomeie o arquivo e crie-o. A ferramenta informa o tamanho combinado da origem e o tamanho do PDF final, então você pode ver se a incorporação das digitalizações produziu algo razoável antes de baixar.
Configurações que importam para uma digitalização
Use Conter para documentos, porque isso garante que a página inteira fique visível e nunca corte uma assinatura ou um carimbo. Cobrir é para digitalizações parecidas com fotos, em que as bordas não carregam informação. Uma margem Média ou Grande dá à página uma borda imprimível e parece deliberada; Nenhuma serve para uma digitalização que você pretende ver apenas na tela. Se uma página chegar deitada, deixe e corrija a orientação no passo três, onde a rotação não recodifica nada.
Passo 2: torne o texto pesquisável
O PDF para texto ferramenta usa uma estratégia em duas etapas que se decide sozinha. Ela primeiro pede a cada página sua camada de texto, o que é instantâneo e exato para qualquer coisa exportada de um processador de texto, um navegador ou uma ferramenta de design. Só para páginas que quase não têm texto real, ou seja, que são realmente apenas uma figura de uma página, ela renderiza a página em resolução dupla e roda OCR nela.
O que a ferramenta realmente oferece
Seja claro sobre a saída antes de confiar nela. A ferramenta devolve as palavras em si, como texto que você pode copiar ou baixar como arquivo de texto simples. Ela não grava uma camada de OCR invisível de volta no PDF, então o próprio PDF não ficará pesquisável em um leitor após este passo. O que você obtém é uma cópia pesquisável e citável do texto do documento ao lado do PDF, que é o que a maioria das tarefas de arquivamento e citação realmente precisa.
- Adicione o PDF. Solte o arquivo que você criou no passo um. Se o PDF pedir uma senha, desbloqueie-o primeiro com o desbloquear PDF ferramenta, porque este leitor não consegue abrir um arquivo bloqueado.
- Escolha o idioma do OCR se precisar. A escolha só afeta páginas digitalizadas; uma página com uma camada de texto real é lida como está, seja qual for o idioma. O inglês roda a partir de dados locais, outros idiomas são baixados uma vez e armazenados em cache.
- Execute e leia o resumo. O resultado informa quantas páginas vieram de uma camada de texto e quantas precisaram de reconhecimento, então você sabe qual parte da saída merece uma revisão antes de confiar nela.
O reconhecimento é bom em digitalizações limpas e retas em uma resolução sensata e nitidamente pior em páginas tortas, apagadas ou manuscritas. Trate a saída do OCR como um rascunho que você confere, não como uma transcrição que você pode arquivar sem ler.
Passo 3: coloque as páginas na ordem certa
O organizar PDF ferramenta renderiza uma miniatura para cada página e permite reconstruir o documento antes de exportar. É onde as correções que o passo um não consegue fazer, como uma página deitada ou uma folha digitalizada duas vezes, são resolvidas sem tocar na digitalização original de novo.
- Reordenar arrastando uma miniatura, ou com as setas para a esquerda e para a direita para uso com teclado e toque.
- Girar uma única página ou uma seleção inteira em 90 graus por vez. A rotação é armazenada como geometria da página, então a imagem não é recodificada.
- Excluir páginas em branco ou duplicadas, com um botão de desfazer que retrocede pelas suas últimas alterações se uma página desaparecer por engano.
- Adicionar números de página se você os quiser, escolhendo o número inicial e se ficam no canto inferior direito, no canto superior direito ou centralizados no rodapé da página.
Os números são desenhados em uma face Helvetica padrão, então eles renderizam igual em todos os lugares. A ferramenta grava um novo arquivo em vez de editar no lugar, então o seu PDF original permanece intacto e um erro aqui custa apenas uma nova execução.
Passo 4: bloqueie-o com uma senha
O proteger PDF ferramenta criptografa o documento finalizado com AES-256 no navegador, usando uma versão WebAssembly do qpdf. A criptografia acontece localmente, então a senha e o arquivo nunca viajam juntos por uma rede, que é o modo de falha que você está tentando evitar desde o início.
Senha de abertura versus senha de proprietário
Há duas senhas, e elas fazem trabalhos diferentes. A senha de usuário é a que qualquer pessoa precisa digitar para abrir o documento. A senha de proprietário controla as permissões que viajam com o arquivo. Se você deixar a senha de proprietário em branco, ela assume o mesmo valor da senha de usuário, o que é suficiente para um arquivo pessoal e menos flexível para um documento que você distribui.
- Adicione o PDF e defina a senha de usuário. Quatro caracteres é o mínimo que a ferramenta aceita, e ela verifica se o campo de confirmação coincide antes de começar.
- Defina a senha de proprietário e as permissões. Decida separadamente se a impressão é permitida, se o texto pode ser copiado e se o documento pode ser modificado.
- Criptografe e baixe. O resultado é gravado com um sufixo de protegido para não sobrescrever o original. Mantenha uma cópia não criptografada em algum lugar seguro, porque uma senha esquecida em um arquivo AES-256 não é recuperável aqui.
Dois limites se aplicam. Arquivos maiores que 50 MB são recusados, então divida uma digitalização muito grande primeiro. Um documento que já está protegido por senha precisa ser desbloqueado antes de poder ser criptografado de novo.
Dois passos opcionais
Nenhum dos dois é obrigatório, e vale conhecer ambos porque seus limites são fáceis de entender mal.
Reduza primeiro uma digitalização inchada
O comprimir PDF ferramenta é uma reescrita estrutural sem perdas: ela agrupa objetos em fluxos, recompacta os fluxos que consegue e reconstrói a tabela de referência cruzada. O que ela não faz é recodificar as imagens dentro de uma digitalização, então um arquivo cujo tamanho é em sua maior parte imagens não encolherá muito. Em um PDF pequeno e já compacto, a saída pode até crescer, porque o fluxo de objetos e a linearização carregam seu próprio custo. A ferramenta diz isso honestamente quando acontece. Execute antes do passo quatro para poder comparar tamanhos enquanto o arquivo ainda está desbloqueado.
Aplique marca d'água às imagens antes de criar o PDF
Se uma cópia de rascunho precisar ser marcada, adicione a marca d'água às imagens das páginas com o marca d'água em imagem ferramenta antes do passo um. Ele suporta marcas d'água de texto com posição, tamanho, cor, opacidade, rotação e um modo lado a lado, e consegue processar um lote de imagens em uma passagem. Dois limites importam: ele coloca texto, e não uma imagem ou um logo, e a pilha de fontes é latina, então alfabetos não latinos podem não renderizar como você espera. Faça a marca d'água nas imagens soltas, porque as ferramentas de PDF aqui não adicionam uma sobreposição de texto ou imagem a um documento finalizado.
Onde este fluxo de trabalho para
Este é um fluxo de trabalho privado de navegador, não um sistema de gestão de documentos, e alguns trabalhos ficam fora dele.
- Sem saída de PDF pesquisável. O passo dois dá a você texto pesquisável como um arquivo auxiliar. Se um sistema insistir em um PDF cuja própria camada de texto seja pesquisável, este fluxo de trabalho não produz esse arquivo.
- O OCR é tão bom quanto a digitalização. Caligrafia, páginas tortas, grampos e fotocópias de baixo contraste produzem erros. Digitalizações limpas, retas e em 300 dpi são onde o reconhecimento funciona bem.
- Compressão não é compressão de imagem. O compressor de PDF não consegue encolher uma digitalização cheia de imagens. Digitalizar de novo em uma resolução menor ou comprimir as imagens antes do passo um é a forma de cortar esse tipo de tamanho.
- A criptografia tem um teto de tamanho. As ferramentas de proteção e compressão ambas param em 50 MB, então uma digitalização muito grande precisa ser dividida primeiro.
- Um documento por vez. Cada passo trabalha em um único arquivo, então um lote de documentos separados é um lote de execuções, e não um único trabalho.
- Os mecanismos são baixados no primeiro uso. Os mecanismos de PDF e OCR têm alguns megabytes, buscados uma vez e armazenados em cache. Esse é o custo de fazer o trabalho na sua máquina.