Estudantes geralmente precisam de três coisas de uma ferramenta de arquivos: transformar uma pilha de fotos de celular em um PDF pronto para entrega, extrair texto copiável de um capítulo digitalizado e reduzir um arquivo para caber em um limite de upload. As três podem ser feitas no navegador, sem instalar nada e sem enviar seu trabalho.
Esse último ponto importa mais do que parece. Trabalhos, históricos escolares, atestados médicos e rascunhos de tese são exatamente o tipo de arquivo que as pessoas relutam em entregar a um site aleatório, e as redes do campus costumam ser lentas o bastante para que um upload de 40 MB seja um problema à parte. Uma ferramenta de navegador lê o arquivo do seu disco, faz o trabalho no seu próprio processador e devolve o resultado na hora, então nada é transmitido e não há espera de upload. Também não há conta envolvida, o que é uma coisa a menos para lembrar às 2 da manhã antes de um prazo.
Transformar fotos de páginas em um PDF
O arquivo de estudante mais comum não é um documento, é um conjunto de fotos de celular de um folheto, um livro da biblioteca ou um quadro branco. Entregar oito arquivos JPEG separados normalmente não é aceito, então eles precisam virar um único PDF na ordem correta.
Adicione todas as fotos de uma vez, arraste os cartões até a ordem corresponder às páginas, depois escolha A4 ou Letter, a orientação, a margem e como cada imagem deve se ajustar à página. Arquivos JPG e PNG são incorporados como estão, e imagens WebP, GIF ou AVIF são convertidas primeiro. Cada imagem vira uma página, e o arquivo nunca sai do seu dispositivo.
Não há limite de quantidade de imagens. O teto prático é a sua própria memória, já que cada foto fica localmente enquanto o PDF é montado.
Imagem para PDF
Solte as fotos, defina a ordem das páginas, o tamanho e as margens, depois baixe um PDF. Nada é enviado.
Extrair texto copiável de um capítulo digitalizado
Uma lista de leitura digitalizada é a imagem de uma página, então selecionar o texto não faz nada. Você tem dois caminhos, dependendo do que já tem.
Se as páginas forem fotos ou capturas de tela
Use o Imagem para texto. Adicione uma imagem ou várias, escolha o idioma do texto e execute o reconhecimento. O inglês é integrado, e mais onze idiomas, incluindo chinês, japonês, coreano, alemão, francês, espanhol, russo e árabe, podem ser selecionados no menu de idiomas. A primeira execução baixa cerca de 6,5 MB de mecanismo de reconhecimento e dados de idioma, e seu navegador os armazena em cache, então as execuções seguintes começam quase instantaneamente.
Se as páginas já estiverem em um PDF
Use o PDF para texto, que trata os dois casos. Páginas que carregam uma camada de texto real são extraídas diretamente, o que é instantâneo e perfeitamente preciso. Páginas que são apenas uma imagem são renderizadas e reconhecidas com OCR. O resumo ao lado do resultado diz quantas páginas vieram de cada caminho, então você sabe qual parte da saída merece uma revisão mais atenta.
PDF para texto
Lê a camada de texto instantaneamente e roda OCR nas páginas digitalizadas, tudo no navegador.
Ajustar um arquivo a um limite de upload
Portais e gateways de e-mail limitam anexos, e uma digitalização exportada com qualidade total pode facilmente ultrapassá-los. Duas ferramentas cobrem quase todos os casos.
Comprimir PDF reescreve os fluxos internos de um PDF usando qpdf compilado para WebAssembly. A configuração Padrão os reempacota no nível de compressão 6, e a Máximo usa o nível 9 e também lineariza o arquivo, para que um leitor possa mostrar a primeira página antes de o download terminar. A ferramenta é projetada para arquivos com menos de 50 MB.
Compressor de imagem lida com fotos e capturas de tela com um controle deslizante de qualidade e um tamanho antes e depois ao vivo, e pode recomprimir um PNG sem perdas com OxiPNG.
Uma ressalva que vale declarar claramente: nenhuma das ferramentas aceita um tamanho alvo. Você não pode digitar 100 KB e obter exatamente isso. Você baixa a configuração até a prévia mostrar um tamanho com que consiga conviver, que é a versão honesta do que essas ferramentas fazem.
O que essas ferramentas não podem fazer
- Sem reconhecimento de escrita à mão. O OCR é treinado em texto impresso, então anotações de aula à mão produzirão erros. Trate a saída como um rascunho.
- Sem edição de texto existente em PDF. Você não pode reescrever um parágrafo dentro de um PDF. Você pode adicionar números de página, uma marca d'água ou uma assinatura por cima, e pode reordenar ou combinar páginas.
- Sem compressão ilimitada. Force demais o texto digitalizado e ele deixa de ser legível. Há um piso, e ele chega antes que o tamanho do arquivo pare de cair.