Aller au contenu principal
Werkzeu.ge
Dashboard
Le PDF est envoyé à notre serveur pour la reconnaissance de texte (OCR). Contrôle le texte reconnu avant de le réutiliser.
PlusOutils PDF

PDF-Texterkennung - Reconnaissance de texte dans les PDF

Ton Steuerbescheid (avis d’imposition) est scanné, mais tu ne peux ni sélectionner, ni copier, ni chercher les chiffres ? La PDF-Texterkennung lit le texte de ton PDF scanné, page par page, avec aperçu, indices de confiance et recherche plein texte, optimisée pour le courrier des administrations allemandes.

Un coup d'œil à l'intérieur

PDF StudioPDF-Texterkennung - Reconnaissance de texte dans les PDFDémo fictive | Plus
PDF

Reconnaissance page par page

PDF/A
Reconnaissance page par page
Allemand, anglais ou les deux
Préréglages pour le courrier administratif
Trois niveaux de résolution
Aperçu en lecture seule. Pour l'utiliser, ouvre l'outil.

Cet aperçu sécurisé montre à quoi sert l'outil, sans exécuter d'actions liées à un compte.

Ce que sait faire PDF-Texterkennung - Reconnaissance de texte dans les PDF

Un PDF scanné, c’est en gros une photo. Pour l’œil, ça ressemble à du texte, mais l’ordinateur ne voit que des pixels : tu ne peux rien sélectionner, rien copier, rien chercher. L’OCR (reconnaissance optique de caractères) change ça : elle repère les lettres dans l’image et en fait du vrai texte, où l’on peut chercher. C’est exactement ce que fait la PDF-Texterkennung, page par page et avec aperçu, pour que tu voies ce qui a été reconnu.

L’accent est mis sur le courrier des administrations et des finances allemandes. Steuerbescheide (avis d’imposition), courriers d’administrations, contrats, actes, factures : tout cela arrive souvent scanné, et c’est particulièrement pénible quand tu veux réutiliser les chiffres et les échéances qu’ils contiennent. Des préréglages prêts à l’emploi ajustent la langue et la résolution au type de document, pour que tu ne perdes pas de temps avec les réglages.

La reconnaissance fonctionne en allemand, en anglais ou avec les deux mélangés. Les textes allemands avec trémas et ß, en particulier, gagnent à ce que tu choisisses la bonne langue. Pour les documents qui mélangent les deux langues, il y a le mode combiné, qui utilise les deux dictionnaires en même temps.

La résolution décide de la précision et de la vitesse. 150 DPI est rapide et suffit pour des pages propres, bien imprimées. 300 DPI est le standard pour la plupart des documents. 600 DPI donne le maximum avec de petits caractères, des contrats ou des scans un peu délavés, mais prend un peu plus de temps. Pour chaque page, tu obtiens un indice de confiance qui montre à quel point la reconnaissance était sûre.

Tu peux regarder le résultat page par page ou en texte continu, chercher dedans directement dans le navigateur et extraire le texte reconnu, prêt à être réutilisé, par exemple pour reprendre un chiffre dans un calculateur ou transférer une échéance dans le Fristenwächter (le gardien des échéances). Le nombre de mots et de caractères de chaque page reste toujours sous tes yeux.

La reconnaissance des caractères elle-même demande de la puissance de calcul et tourne donc sur le serveur, mais uniquement pour cette étape. Tes documents ne sont pas conservés durablement. Pas d’abonnement pour un simple scan, pas de détour par un service cloud étranger aux conditions de confidentialité obscures.

Fonctions

Reconnaissance page par page

Chaque page est reconnue séparément et affichée avec un aperçu, pour que tu compares le texte et l’original.

Allemand, anglais ou les deux

Choisis la langue qui correspond au document. Le mode combiné utilise les deux dictionnaires en même temps.

Préréglages pour le courrier administratif

Courrier d’administration, Steuerbescheid, contrat ou facture, chacun avec la langue et la résolution qui conviennent.

Trois niveaux de résolution

150 DPI rapide, 300 DPI standard, 600 DPI pour les petits caractères et les scans difficiles.

Indice de confiance par page

Une valeur par page montre à quel point la reconnaissance était sûre, pour que tu saches où vérifier.

Recherche en texte intégral

Cherche dans le texte reconnu directement dans le navigateur et retrouve tout de suite un chiffre, un nom ou une échéance.

Extraire le texte

Regarde le résultat page par page ou en continu et reprends le texte pour le réutiliser.

Comment ça marche

  1. 1

    Charger le PDF scanné

    Choisis le document scanné. Même les scans de plusieurs pages jusqu’à 50 Mo ne posent aucun problème.

  2. 2

    Choisir la langue et la qualité

    Allemand, anglais ou les deux, plus la résolution. Un préréglage comme Steuerbescheid ajuste les deux comme il faut.

  3. 3

    Lancer la reconnaissance

    Le texte est reconnu page après page. Pour chaque page, tu vois l’aperçu, l’indice de confiance et la quantité de texte.

  4. 4

    Chercher et reprendre

    Cherche dans le texte, vérifie les passages incertains et reprends le résultat pour le réutiliser.

Pour qui

→Pour qui veut réutiliser les chiffres d’un Steuerbescheid (avis d’imposition) scanné.
→Pour toute personne qui veut rendre un courrier d’administration consultable par recherche.
→Pour la comptabilité qui extrait le texte de factures scannées.
→Pour qui rend de nouveau lisibles des contrats et des actes issus d’une archive de scans.
→Pour les gens qui numérisent leur courrier papier et le transforment en vrai texte.

Questions fréquentes

L’OCR, c’est quoi au juste ?

OCR veut dire reconnaissance optique de caractères. Elle repère les lettres dans une image ou un PDF scanné et en fait du vrai texte, où l’on peut chercher et que l’on peut copier. D’une photo d’écriture, on retrouve de l’écriture, avec laquelle l’ordinateur peut travailler.

L’outil reconnaît-il les trémas allemands ?

Oui. Choisis l’allemand comme langue et les lettres ä, ö, ü et ß sont reconnues correctement. Pour les documents qui mélangent allemand et anglais, il y a le mode combiné.

Quelle résolution choisir ?

300 DPI est le standard et convient à la plupart des documents. Prends 150 DPI pour des pages bien imprimées quand il faut aller vite, et 600 DPI pour de petits caractères, des contrats ou des scans un peu délavés.

Que signifie l’indice de confiance ?

L’indice de confiance montre à quel point la reconnaissance était sûre pour une page. Une valeur basse indique que tu devrais vérifier cette page de plus près, par exemple en cas de mauvais scan ou d’écriture inhabituelle.

Mes documents restent-ils privés ?

La reconnaissance des caractères demande de la puissance de calcul et tourne sur le serveur, mais uniquement pour cette étape. Tes documents ne sont pas conservés durablement ni transmis à des services tiers.

Puis-je traiter des scans de plusieurs pages ?

Oui. L’outil traite des PDF de plusieurs pages jusqu’à 50 Mo et te montre le résultat de chaque page séparément ainsi qu’en texte continu.

Bild-Text-OCR - OCR d'image en texte

Reconnais et extrais du texte à partir d'images, de scans et de captures d'écran. Allemand, a…

PDF zu Bild - De PDF à image

Convertis des pages PDF en local en JPG, PNG ou WebP ; l'AVIF est encodé de façon transparent…

Scanner le document

Photographie des documents avec ton téléphone, marque les coins, redressement par le serveur.…

PDF bearbeiten - Modifier un PDF

Modifie des fichiers PDF directement dans le navigateur : texte, surlignages, soulignements,…

Prêt pour PDF-Texterkennung - Reconnaissance de texte dans les PDF ?

Sans installation. Inclus à partir de Plus. S’ouvre directement dans le navigateur.

Ouvrir maintenant