Les étudiants attendent surtout trois choses d'un outil de fichiers : transformer une pile de photos prises au téléphone en un seul PDF prêt à rendre, obtenir du texte copiable à partir d'un chapitre scanné, et faire tenir un fichier sous une limite de téléversement. Les trois se font dans le navigateur, sans rien installer et sans téléverser votre travail.
Ce dernier point compte plus qu'il n'y paraît. Les devoirs, relevés de notes, dossiers médicaux et thèses en cours sont exactement le type de fichiers que les gens hésitent à confier à un site web quelconque, et les réseaux de campus sont souvent assez lents pour qu'un téléversement de 40 MB soit un problème en soi. Un outil dans le navigateur lit le fichier depuis votre disque, fait le travail sur votre propre processeur et vous rend directement le résultat : rien n'est transmis et il n'y a aucune attente de téléversement. Aucun compte n'est impliqué non plus, une chose de moins à retenir à 2 heures du matin avant une échéance.
Transformer des photos de pages en un seul PDF
Le fichier étudiant le plus courant n'est pas du tout un document : c'est un ensemble de photos prises au téléphone d'un polycopié, d'un livre de bibliothèque ou d'un tableau blanc. Rendre huit fichiers JPEG séparés n'est généralement pas accepté : ils doivent donc devenir un seul PDF dans le bon ordre.
Ajoutez toutes les photos d'un coup, faites glisser les cartes jusqu'à ce que l'ordre corresponde aux pages, puis choisissez A4 ou Letter, l'orientation, la marge et la façon dont chaque image doit s'ajuster à la page. Les fichiers JPG et PNG sont intégrés tels quels, et les images WebP, GIF ou AVIF sont d'abord converties. Chaque image devient une page, et le fichier ne quitte jamais votre appareil.
Il n'y a aucune limite de nombre d'images. Le plafond pratique est votre propre mémoire, car chaque photo est conservée localement pendant l'assemblage du PDF.
Image en PDF
Déposez les photos, définissez l'ordre des pages, la taille et les marges, puis téléchargez un seul PDF. Rien n'est téléversé.
Obtenir du texte copiable à partir d'un chapitre scanné
Une liste de lecture scannée est une image d'une page : sélectionner le texte ne fait donc rien. Vous avez deux voies selon ce que vous possédez déjà.
Si les pages sont des photos ou des captures d'écran
Utilisez Image en texte. Ajoutez une ou plusieurs images, choisissez la langue du texte et lancez la reconnaissance. L'anglais est intégré, et onze autres langues dont le chinois, le japonais, le coréen, l'allemand, le français, l'espagnol, le russe et l'arabe peuvent être sélectionnées dans le menu des langues. La première exécution télécharge environ 6,5 MB de moteur de reconnaissance et de données linguistiques, que votre navigateur met en cache : les suivantes démarrent donc presque instantanément.
Si les pages sont déjà dans un PDF
Utilisez PDF en texte, qui gère les deux cas. Les pages qui portent une véritable couche de texte sont extraites directement, ce qui est instantané et parfaitement exact. Les pages qui ne sont qu'une image sont rendues et reconnues par OCR. Le résumé à côté du résultat vous indique combien de pages proviennent de chaque voie, pour que vous sachiez quelle partie du résultat mérite une relecture plus attentive.
PDF en texte
Lit la couche de texte instantanément et exécute l'OCR sur les pages scannées, le tout dans le navigateur.
Ramener un fichier sous une limite de téléversement
Les portails et les passerelles e-mail plafonnent les pièces jointes, et un scan exporté en pleine qualité peut facilement les dépasser. Deux outils couvrent presque tous les cas.
Compresser un PDF réécrit les flux internes d'un PDF à l'aide de qpdf compilé en WebAssembly. Le réglage Standard les recompacte au niveau de compression 6, et Maximum utilise le niveau 9 et linéarise aussi le fichier pour qu'un lecteur puisse afficher la première page avant la fin du téléchargement. L'outil est conçu pour les fichiers de moins de 50 MB.
Compresseur d'image gère les photos et captures d'écran avec un curseur de qualité et une taille avant/après en direct, et peut recompresser un PNG sans perte avec OxiPNG.
Une mise en garde à énoncer clairement : aucun des deux outils ne prend de taille cible. Vous ne pouvez pas saisir 100 KB et obtenir exactement cela. Vous baissez le réglage jusqu'à ce que l'aperçu affiche une taille acceptable, ce qui est la version honnête de ce que font ces outils.
Ce que ces outils ne peuvent pas faire
- Pas de reconnaissance de l'écriture manuscrite. L'OCR est entraîné sur du texte imprimé, les notes de cours manuscrites produiront donc des erreurs. Considérez le résultat comme un brouillon.
- Pas de modification du texte existant d'un PDF. Vous ne pouvez pas reformuler un paragraphe à l'intérieur d'un PDF. Vous pouvez ajouter des numéros de page, un filigrane ou une signature par-dessus, et vous pouvez réorganiser ou fusionner des pages.
- Pas de compression illimitée. Poussez trop loin la compression d'un texte scanné et il cesse d'être lisible. Il y a un plancher, et il arrive avant que la taille de fichier cesse de baisser.