OCR gratuit pour PDF scannés, dans votre navigateur

Transformer un document scanné en texte sélectionnable prend désormais moins de 3 secondes pour 10 Mo, sans envoyer votre fichier sur aucun serveur. iSharePDF intègre un moteur OCR entièrement exécuté dans votre navigateur grâce à WebAssembly : vos contrats, relevés bancaires ou archives numérisées ne quittent jamais votre appareil. Avec 100 Mo de limite par fichier, un chiffrement AES-256 pour les documents Pro et 28 outils PDF disponibles sans installation, c'est la solution d'extraction de texte sur PDF scanné la plus privée du marché en 2026.

Ce que fait l'outil OCR de iSharePDF

L'outil OCR PDF gratuit d'iSharePDF détecte automatiquement les zones de texte dans un fichier image ou un PDF numérisé, puis génère une couche de texte invisible superposée aux pages. Résultat : votre PDF reste visuellement identique, mais vous pouvez désormais :

Le moteur supporte plus de 40 langues dont le français, l'anglais, l'espagnol, l'arabe et le mandarin. Les documents mixtes (blocs français + anglais sur la même page) sont reconnus sans configuration. La précision atteint 97 à 99 % sur des scans de bonne qualité (300 dpi minimum recommandé).

Après traitement, vous pouvez enchaîner directement sur un outil de compression pour réduire le poids du fichier enrichi, ou passer par l'outil d'annotation pour commenter vos extraits sans retourner sur l'original.

Comment fonctionne le traitement local (WebAssembly)

La grande majorité des outils OCR en ligne envoient votre PDF vers un serveur distant qui effectue la reconnaissance, puis vous retourne le fichier. iSharePDF fonctionne différemment : le moteur Tesseract compilé en WebAssembly s'exécute directement dans votre onglet Chrome, Firefox ou Safari.

Concrètement, voici ce qui se passe quand vous déposez un fichier :

Ce pipeline purement navigateur explique pourquoi le traitement d'un document de 10 Mo prend environ 3 secondes sur un ordinateur portable récent, contre 8 à 15 secondes pour les solutions cloud qui incluent le temps de transfert réseau aller-retour. La limite est fixée à 100 Mo par fichier, ce qui couvre la quasi-totalité des scans professionnels.

Pourquoi uploader un PDF scanné est un risque RGPD en 2026

Un relevé de compte, un contrat signé, un acte notarié ou une ordonnance médicale contient des données personnelles au sens du RGPD. Dès qu'il est envoyé vers un serveur tiers, même si le prestataire affirme "supprimer le fichier après X minutes", plusieurs problèmes légaux se posent :

Avec iSharePDF, aucun octet de votre document ne sort de votre navigateur. Il n'y a physiquement pas de serveur à compromettre, pas de logs à effacer, pas de DPA à négocier. C'est la seule architecture qui garantit une conformité RGPD par conception (privacy by design) pour l'extraction de texte PDF.

Tutoriel (en 4 étapes)

L'interface est volontairement minimaliste pour ne pas ralentir un workflow professionnel :

Pour les fichiers multi-pages (plus de 20 pages), le compte Pro traite les lots en parallèle sur 4 threads WebAssembly, divisant le temps de traitement par 3 environ. Vous pouvez ensuite scinder le résultat en chapitres si nécessaire.

Cas d'usage professionnels

L'extraction de texte sur document scanné intervient dans des contextes très variés :

iSharePDF s'intègre aussi dans des workflows plus complexes : après l'OCR, utilisez l'outil protection par mot de passe pour sécuriser le fichier enrichi avant partage, ou fusionnez plusieurs documents traités en un seul PDF consultable.

Limites à connaître avant de commencer

L'honnêteté sur les limites fait partie de l'approche iSharePDF :

Tarifs : gratuit ou Pro 4,99 €/mois

L'outil OCR est utilisable gratuitement sans création de compte, sans filigrane et sans limite de documents par jour. Les 28 outils du tableau de bord sont accessibles dans les mêmes conditions.

Le compte Pro à 4,99 €/mois (Stripe, résiliation en 1 clic) débloque :

Aucun essai gratuit limité dans le temps : la version gratuite est permanente et fonctionnelle. Le Pro s'adresse aux professionnels qui traitent de gros volumes ou des documents sensibles nécessitant le niveau de chiffrement maximal.

Questions fréquentes

Mon PDF scanné est-il vraiment traité sans connexion internet après le chargement ?

Oui. Une fois le module WebAssembly téléchargé et mis en cache par votre navigateur (premier usage uniquement), l'outil OCR fonctionne en hors-ligne complet. Vous pouvez activer le mode avion après avoir ouvert la page et le traitement se déroulera normalement. Aucun octet de votre document ne transite par un serveur iSharePDF ou tiers.

Quels formats de fichiers sont acceptés en entrée ?

L'outil accepte les fichiers PDF dont les pages sont des images raster (scans de photocopieuse, photos de document, fax numérisés). Les PDF déjà nativement textuels (générés par Word, InDesign, etc.) n'ont pas besoin d'OCR, leur texte est déjà sélectionnable. Les formats image standalone (JPG, PNG, TIFF) ne sont pas encore supportés directement ; convertissez-les d'abord en PDF via n'importe quel outil d'impression virtuelle.

La langue française avec accents et caractères spéciaux est-elle bien reconnue ?

Le français est parmi les langues les mieux supportées par Tesseract : accents (é, è, ê, à, ù, ç, œ), guillemets français (« »), apostrophes courbes et ligatures sont correctement extraits. Sur un scan de bonne qualité, le taux de reconnaissance des caractères français dépasse 98 %. Les chiffres, symboles monétaires (€) et signes de ponctuation sont également bien traités.

Est-ce qu'iSharePDF conserve une copie du texte extrait ?

Non. Le texte extrait n'existe que dans la mémoire vive de votre onglet navigateur pendant le traitement, puis dans le fichier PDF téléchargé sur votre machine. iSharePDF ne dispose d'aucune infrastructure serveur pour stocker du contenu utilisateur. Nos serveurs se limitent à servir les fichiers JavaScript et WebAssembly de l'application, c'est tout.

La version gratuite impose-t-elle un filigrane sur le fichier OCR ?

Non. La version gratuite ne pose aucun filigrane visible ni métadonnée cachée dans le PDF résultant. Le fichier téléchargé est propre et immédiatement utilisable dans n'importe quel lecteur PDF ou workflow professionnel. La distinction entre gratuit et Pro porte uniquement sur les performances de traitement et le niveau de chiffrement, pas sur la qualité du fichier produit.

Que faire si le résultat OCR contient des erreurs sur certains mots ?

Pour les erreurs ponctuelles, ouvrez le PDF dans votre lecteur et utilisez la fonction « Rechercher et remplacer » si disponible. Pour les documents critiques (contrats, actes), un scan à 300 dpi avec bonne luminosité corrige 90 % des cas d'erreur. En cas de scan très dégradé, l'option Pro bêta d'amélioration d'image (prétraitement contraste + déskew) sera disponible courant 2026 pour les abonnés.