OCR PDF en ligne — Numérisation en texte
Convertissez vos documents numérisés en PDF dont le texte est consultable et sélectionnable.
- Reconnaissance de texte précise Une OCR de qualité qui transforme les numérisations en véritable texte sélectionnable.
- Anglais gratuit, davantage avec Pro La reconnaissance de l'arabe et le multilingue sont des fonctionnalités premium.
- Pro débloque plus d'options Numérisations améliorées, sortie PDF/A et export de tableaux.
Téléversez votre fichier
Sécurisé et confidentielDéposez votre PDF ici, ou parcourir
Fichiers PDF uniquement
Taille max. du fichier : 50 MB · Fichiers supprimés immédiatement après le traitement
Chargement de l'aperçu...
Réglages OCR
Choisissez une langue et les options de sortie.
La reconnaissance de l'arabe et le multilingue sont premium.
Avancé
Premium
Passer à l'offre supérieureL'OCR prend généralement de 10 à 40 secondes selon la taille du fichier et la langue.
Extraire les tableaux
Le CSV coûte 1 crédit. L'export Excel est premium.
Sign in to continue. Your uploaded file and workspace will be saved.
Vous n'avez pas de compte ?
Vous avez déjà un compte ?
Upgrade to Pro
Unlock Unlimited Conversions
Get full, unmetered access to every tool and premium export.
Comment appliquer l'OCR à un PDF en ligne
- Téléversez le PDF numérisé que vous devez rendre consultable.
- Choisissez la langue de reconnaissance, et cochez Relancer l'OCR quand même uniquement si la couche de texte existante est erronée.
- Appuyez sur Lancer l'OCR, puis téléchargez le PDF consultable.
Pourquoi appliquer l'OCR à un PDF numérisé
Une numérisation est une image de document. Elle paraît lisible, mais rien de ce qu'elle contient ne peut être recherché, copié, cité ou indexé, ce qui rend un dossier de contrats numérisés pratiquement opaque. L'OCR ajoute une couche de texte invisible derrière l'image : la page conserve exactement son apparence numérisée, tandis que Ctrl+F, le copier-coller, les lecteurs d'écran et la recherche documentaire se mettent enfin à fonctionner. C'est aussi le préalable indispensable à PDF vers Word et à l'extraction de tableaux, qui n'ont rien à lire sans elle.
À propos de la précision de la reconnaissance
La reconnaissance est entraînée sur des caractères imprimés et dactylographiés : les numérisations de bureau propres donnent donc de bons résultats, l'écriture manuscrite non — il n'y a ici aucun modèle de reconnaissance de l'écriture manuscrite, et l'écriture cursive en particulier doit être considérée comme peu fiable, et non simplement comme imparfaite. La précision baisse avec une faible résolution, le flou, l'inclinaison, les taches importantes, les polices décoratives et les mises en page complexes sur plusieurs colonnes. Le traitement de numérisation améliorée peut redresser et débruiter une page de travers ou bruitée avant la reconnaissance, ce qui aide souvent pour les documents photographiés. Aucun moteur d'OCR n'est exempt d'erreurs : les noms, les chiffres et les formulations juridiques méritent donc une relecture avant que vous ne vous y fiiez.
Questions fréquentes
- L'OCR PDF en ligne peut-elle reconnaître l'écriture manuscrite ?
- L'OCR PDF en ligne proposée ici est conçue pour rendre consultables des numérisations de texte imprimé ou dactylographié, non pour reconnaître l'écriture manuscrite. Des majuscules d'imprimerie bien formées peuvent parfois donner des caractères exploitables, mais l'écriture cursive et les écritures variées sont peu fiables, car aucun modèle dédié à l'écriture manuscrite n'est utilisé.
- Que se passe-t-il si mon PDF contient déjà du texte sélectionnable ?
- Le mode par défaut ignore les pages qui possèdent déjà une couche de texte. « Relancer l'OCR quand même » force le passage de chaque page par l'OCR, la rastérise et remplace la couche de texte existante, ce qui peut dégrader la qualité visuelle ou textuelle. À n'utiliser que lorsque le texte actuel est erroné.
- Quelles langues et quelles tailles de document sont prises en charge ?
- L'OCR en anglais coûte un crédit sur l'offre standard. L'arabe, la combinaison anglais + arabe et les documents de plus de cinq pages exigent un accès premium. Le nettoyage amélioré et la sortie PDF/A sont également des options premium.
- L'OCR produira-t-elle un texte parfaitement exact ?
- Aucun système d'OCR ne peut le garantir. La résolution, le flou, l'inclinaison, les taches, les polices inhabituelles, les colonnes et le mélange de langues influent tous sur la reconnaissance. Le nettoyage amélioré peut aider pour les numérisations de travers ou bruitées, mais les noms, les chiffres et les textes juridiques importants doivent toujours être relus.