Uno sguardo dentro
Questa anteprima sicura mostra a cosa serve lo strumento, senza eseguire azioni legate all'account.
Cosa sa fare PDF-Texterkennung - Riconoscimento del testo nei PDF
Un PDF scansionato è in sostanza una foto. All’occhio sembra testo, ma il computer vede solo pixel: non puoi selezionare, copiare o cercare nulla. L’OCR (riconoscimento ottico dei caratteri) ribalta la situazione: riconosce le lettere nell’immagine e le trasforma in testo vero, ricercabile. È quello che fa la PDF-Texterkennung, pagina per pagina e con anteprima, così vedi cosa è stato riconosciuto.
Il focus è sulla posta tedesca di uffici e finanza. Steuerbescheide (avvisi di accertamento fiscale), lettere degli uffici, contratti, atti, fatture: arrivano spesso scansionati, e questo è un problema soprattutto quando vuoi riutilizzare i numeri e le scadenze che contengono. Preset pronti impostano lingua e risoluzione giuste per ogni tipo di documento, così non perdi tempo con le impostazioni.
Il riconoscimento funziona in tedesco, in inglese o in entrambe le lingue mescolate. In particolare i testi tedeschi con dieresi e con la ß traggono vantaggio dalla scelta della lingua giusta. Per i documenti che mescolano le due lingue c’è la modalità combinata, che usa entrambi i dizionari insieme.
La risoluzione decide precisione e velocità. 150 DPI è veloce e basta per pagine pulite, stampate bene. 300 DPI è lo standard per la maggior parte dei documenti. 600 DPI dà il massimo con caratteri piccoli, contratti o scansioni un po’ sbiadite, ma richiede un po’ più di tempo. Per ogni pagina ricevi un valore di affidabilità che mostra quanto il riconoscimento era sicuro.
Puoi guardare il risultato pagina per pagina o come testo continuo, cercarci dentro direttamente nel browser ed estrarre il testo riconosciuto, pronto da riutilizzare, ad esempio per portare un numero in un calcolatore o una scadenza nel Fristenwächter (il guardiano delle scadenze). Il numero di parole e di caratteri di ogni pagina è sempre sotto controllo.
Il riconoscimento vero e proprio richiede potenza di calcolo e gira quindi sul server, ma solo per questo passaggio. I tuoi documenti non vengono conservati in modo permanente. Nessun abbonamento per una semplice scansione, nessuna deviazione verso un servizio cloud estero con condizioni sulla privacy poco chiare.
Funzioni
Riconoscimento pagina per pagina
Ogni pagina viene riconosciuta singolarmente e mostrata con un’anteprima, così confronti testo e originale.
Tedesco, inglese o entrambi
Scegli la lingua adatta al documento. La modalità combinata usa entrambi i dizionari insieme.
Preset per la posta degli uffici
Lettera di un ufficio, Steuerbescheid, contratto o fattura, ognuno con lingua e risoluzione adatte.
Tre livelli di risoluzione
150 DPI veloce, 300 DPI standard, 600 DPI per caratteri piccoli e scansioni difficili.
Affidabilità per ogni pagina
Un valore per pagina mostra quanto il riconoscimento era sicuro, così sai dove ricontrollare.
Ricerca nel testo completo
Cerca nel testo riconosciuto direttamente nel browser e trova subito un numero, un nome o una scadenza.
Estrai il testo
Guarda il risultato pagina per pagina o come testo continuo e prendi il testo per riutilizzarlo.
Come funziona
- 1
Carica il PDF scansionato
Scegli il documento scansionato. Anche le scansioni di più pagine fino a 50 MB non sono un problema.
- 2
Scegli lingua e qualità
Tedesco, inglese o entrambi, più la risoluzione. Un preset come Steuerbescheid imposta tutto in modo adatto.
- 3
Avvia il riconoscimento
Il testo viene riconosciuto pagina per pagina. Per ogni pagina vedi anteprima, affidabilità e quantità di testo.
- 4
Cerca e riutilizza
Cerca nel testo, controlla i punti incerti e prendi il risultato per riutilizzarlo.
A chi serve
Domande frequenti
Che cos’è l’OCR, in realtà?
OCR sta per riconoscimento ottico dei caratteri. Riconosce le lettere in un’immagine o in un PDF scansionato e le trasforma in testo vero, ricercabile e copiabile. Da una foto di scrittura torna così a nascere scrittura, con cui il computer può lavorare.
Lo strumento riconosce le dieresi tedesche?
Sì. Scegli il tedesco come lingua e ä, ö, ü e ß vengono riconosciute correttamente. Per i documenti che mescolano tedesco e inglese c’è la modalità combinata.
Quale risoluzione scelgo?
300 DPI è lo standard e va bene per la maggior parte dei documenti. Scegli 150 DPI per pagine stampate bene, quando serve fare in fretta, e 600 DPI per caratteri piccoli, contratti o scansioni un po’ sbiadite.
Cosa significa il valore di affidabilità?
Il valore di affidabilità mostra quanto il riconoscimento era sicuro per una pagina. Un valore basso è un segnale che conviene controllare quella pagina con più attenzione, ad esempio con una scansione scadente o un carattere insolito.
I miei documenti restano privati?
Il solo riconoscimento dei caratteri richiede potenza di calcolo e gira sul server, ma solo per questo passaggio. I tuoi documenti non vengono conservati in modo permanente né passati a servizi esterni.
Posso elaborare scansioni di più pagine?
Sì. Lo strumento elabora PDF di più pagine fino a 50 MB e ti mostra il risultato di ogni pagina singolarmente e come testo continuo.
Strumenti simili
Bild-Text-OCR - OCR da immagine a testo
Riconosci ed estrai il testo da immagini, scansioni e screenshot. Tedesco, inglese, misto. OC…
PDF in immagine
Converti le pagine PDF in locale in JPG, PNG o WebP; l'AVIF viene codificato in modo traspare…
Scansiona il documento
Fotografa i documenti con il telefono, segna gli angoli, raddrizza sul server. Scansione in b…
PDF bearbeiten - Modifica PDF
Modifica i file PDF direttamente nel browser: testo, evidenziazioni, sottolineature, barratur…
Pronto per PDF-Texterkennung - Riconoscimento del testo nei PDF?
Nessuna installazione. Incluso a partire da Plus. Si apre direttamente nel browser.
Apri ora