1Téléchargez le scan PDF documents; un scan à échelle grise de 300 DPI propre donne au reconnu le plus à travailler avec.
2Dites-lui quelle langue vous pouvez attendre — en donnant le nom de la langue, vous la laissez deviner par une large marge.
3Exécutez le passe de reconnaissance; les mots sont réécrits comme une couche invisible assise sur l'image de page originale.
4Télécharger le fichier de recherche PDF — il semble identique, mais vous pouvez maintenant rechercher et sélectionner le texte dans celui-ci.
OCR PDF FAQ
Quelque chose de spécifique à PDF ici?
+
Oui — un PDF est un graphique objet, pas une image de page, donc le texte reste sélectionnable et les vecteurs restent pointus, peu importe ce qui arrive au contenu raster à l'intérieur. Cela affecte ce que le reconnu peut voir.
Que dois-je scanner pour obtenir le meilleur résultat?
+
300 DPI en échelle grise est le spot doux. En dessous de 200 DPI formes de caractères commencent à se décomposer; au-dessus de 400 DPI vous gagnez presque rien et payez pour elle dans la taille du fichier et le temps de traitement.
Comment OCR PDF transforme-t-il un scan en texte?
+
Concrètement, chaque page est rendue, exécutée à travers un passe de reconnaissance texte de Tesseract, et les mots reconnus sont réécrits comme une couche de texte invisible positionnée sur l'image originale — de sorte que la page semble inchangée, mais est consultable et sélectionnable. La page ressemble toujours exactement à elle — le texte reconnu se trouve invisiblement derrière l'image ainsi la recherche et la sélection fonctionnent sans changer l'apparence.
Quelles langues peut-elle reconnaître?
+
Plus de 100, y compris le latin, le cyrillique, le grec, l'arabe, l'hébreu, le chinois, le japonais, le coréen et les scripts Indic.
Est-ce que OCR PDF coûte quelque chose?
+
Non. OCR PDF est gratuit sans compte, et rien n'est inscrit sur les pages. Les documents téléchargés sont supprimés des travailleurs peu après la fin du travail.
Que puis-je télécharger sur OCR PDF?
+
Tout PDF standard, y compris ceux produits par un scanner, par un processeur de texte ou par un pilote d'impression. Les fichiers avec un mot de passe propriétaire qui limite uniquement l'édition sont traités; les fichiers qui ont besoin d'un mot de passe utilisateur pour ouvrir ne sont pas, et nous ne essayons pas de briser le chiffrement.
Y a-t-il une limite de taille de fichier sur OCR PDF?
+
Oui : les comptes libres traitent les documents jusqu'à 5 MB chacun, qui couvre la plupart des rapports et des contrats mais pas un long document scanné à 600 DPI; Ghostscript et qpdf font le travail. Les PDF numérisés sont la chose habituelle qui dépasse le document, et la compression du document d'abord suffit normalement pour le ramener sous.
Les signets, les liens et les champs de formation survivent-ils?
+
Les lignes directrices, les liens internes et les annotations sont conservés partout où l'opération le permet. Les signatures numériques sont l'exception : toute modification du fichier invalide nécessairement une signature, car c'est précisément pour cela qu'une signature est signée.
Pourquoi un site MP3 héberge-t-il OCR PDF?
+
MP3.to est construit autour du format qui rend l'audio portable ordinaire: universellement jouable, assez petit pour ignorer, et perdu d'une manière qui importe seulement si vous continuez à le recoder. Cluster d'emplois audio : la personne qui a besoin d'un format modifié a généralement besoin de la taille du fichier, nivelé ou réduit dans la même séance. Mettre OCR PDF derrière le même téléchargement, les mêmes capsules et le même compte est ce qui transforme trois onglets en un.
Que dois-je faire avec le résultat une fois OCR PDF terminé?
+
Le convertisseur sur ce site déplace l'audio entre MP3, WAV, FLAC, M4A, OGG et Opus, de sorte que le format de sortie est une décision que vous pouvez laisser jusqu'à la fin plutôt que de vous engager au début. Faire cela après OCR PDF plutôt qu'avant signifie que l'encode se produit une fois, sur le fichier sur lequel vous avez effectivement réglé, au lieu de deux fois.
Est-ce que OCR PDF ici le même outil que les sites de frères et sœurs fonctionne?
+
Les moteurs sont partagés — la même construction de ffmpeg, les mêmes travailleurs, les mêmes limites. Ce qu'un site MP3 ajoute est un point de vue sur les bits, sur ce qui survit à un encode et sur quand un intermédiaire sans perte vaut le temps de téléchargement. Il commence également par un fait sur le format de ce site est nommé d'après: Les images MP3 sont des blocs de taille fixe, de sorte qu'une coupure atterrit sur une bordure d'image et que les marqueurs de lecture sans écart ne survivent pas à un réencodement.
Ai-je besoin d'un compte, et est-ce que quelque chose est gardé?
+
Aucun compte, et rien n'est conservé : les téléchargements sont supprimés des travailleurs peu après la fin du travail, rien n'est écouté et rien n'est indexé. Des comptes gratuits existent pour l'historique et la taille des lots, pas pour l'accès.