Rzut oka do środka
Ten bezpieczny podgląd pokazuje, do czego służy narzędzie, bez wykonywania akcji wymagających konta.
Co potrafi PDF-Texterkennung
Zeskanowany PDF to w gruncie rzeczy zdjęcie. Dla oka wygląda jak tekst, ale komputer widzi tylko piksele - niczego nie zaznaczysz, nie skopiujesz ani nie wyszukasz. OCR (optyczne rozpoznawanie znaków) odwraca ten stan: rozpoznaje litery na obrazie i zamienia je w prawdziwy, przeszukiwalny tekst. Dokładnie to robi PDF-Texterkennung, strona po stronie i z podglądem, żeby było widać, co zostało rozpoznane.
Nacisk leży na niemieckiej poczcie urzędowej i finansowej. Steuerbescheide (decyzje podatkowe), pisma z urzędów, umowy, akty, faktury - to wszystko często przychodzi jako skan i jest szczególnie uciążliwe wtedy, gdy chcesz dalej wykorzystać zawarte w nich liczby i terminy. Gotowe ustawienia dobierają język i rozdzielczość do rodzaju dokumentu, więc nie musisz tracić czasu na opcje.
Rozpoznawanie działa po niemiecku, po angielsku albo w obu językach naraz. Szczególnie niemieckie teksty z umlautami i ostrym ß zyskują na wyborze właściwego języka. Dla dokumentów, które mieszają oba języki, jest tryb łączony, który korzysta z obu słowników jednocześnie.
Rozdzielczość decyduje o dokładności i szybkości. 150 DPI jest szybkie i wystarcza dla czystych, wyraźnie wydrukowanych stron. 300 DPI to standard dla większości dokumentów. 600 DPI wyciąga maksimum z drobnego druku, umów i lekko rozmytych skanów, ale trwa trochę dłużej. Przy każdej stronie dostajesz wskaźnik pewności, który pokazuje, jak pewne było rozpoznanie.
Wynik możesz oglądać strona po stronie albo jako jeden ciągły tekst, przeszukiwać go od razu w przeglądarce i wyciągnąć rozpoznany tekst - gotowy do dalszego użycia, na przykład żeby przenieść liczbę do kalkulatora albo termin do Fristenwächter. Liczbę słów i znaków na stronie masz zawsze na oku.
Samo rozpoznawanie znaków potrzebuje mocy obliczeniowej, dlatego działa na serwerze, ale tylko w tym jednym kroku. Twoje dokumenty nie są zapisywane na stałe. Żadnej subskrypcji za zwykły skan, żadnego objazdu przez zagraniczną chmurę z niejasnymi zasadami ochrony danych.
Funkcje
Rozpoznawanie strona po stronie
Każda strona jest rozpoznawana osobno i pokazywana z miniaturą, żeby można było porównać tekst z oryginałem.
Niemiecki, angielski lub oba
Wybierz język pasujący do dokumentu. Tryb łączony korzysta z obu słowników jednocześnie.
Gotowe ustawienia dla poczty z urzędów
Pismo z urzędu, Steuerbescheid, umowa albo faktura - każde z dopasowanym językiem i rozdzielczością.
Trzy poziomy rozdzielczości
150 DPI szybko, 300 DPI standard, 600 DPI dla drobnego druku i trudnych skanów.
Wskaźnik pewności dla strony
Jedna wartość na stronę pokazuje, jak pewne było rozpoznanie - wiesz więc, gdzie warto zajrzeć jeszcze raz.
Wyszukiwanie pełnotekstowe
Przeszukuj rozpoznany tekst od razu w przeglądarce i natychmiast znajdź liczbę, nazwisko albo termin.
Wyciągnięcie tekstu
Zobacz wynik strona po stronie albo w całości i weź tekst do dalszej obróbki.
Jak to działa
- 1
Wczytaj zeskanowany PDF
Wybierz zeskanowany dokument. Także wielostronicowe skany do 50 MB nie są problemem.
- 2
Wybierz język i jakość
Niemiecki, angielski lub oba, do tego rozdzielczość. Ustawienie takie jak Steuerbescheid dobiera jedno i drugie.
- 3
Uruchom rozpoznawanie
Tekst jest rozpoznawany strona po stronie. Przy każdej stronie widzisz podgląd, pewność rozpoznania i ilość tekstu.
- 4
Przeszukaj i przejmij
Przeszukaj tekst, sprawdź niepewne miejsca i weź wynik do dalszego użycia.
Dla kogo
Najczęstsze pytania
Czym właściwie jest OCR?
OCR to optyczne rozpoznawanie znaków. Rozpoznaje litery na obrazie albo w zeskanowanym PDF i zamienia je w prawdziwy tekst, który można przeszukiwać i kopiować. Ze zdjęcia pisma znów robi się pismo, z którym komputer może pracować.
Czy narzędzie rozpoznaje niemieckie umlauty?
Tak. Wybierz niemiecki jako język, a ä, ö, ü i ß zostaną rozpoznane poprawnie. Dla dokumentów, które mieszają niemiecki i angielski, jest tryb łączony.
Jaką rozdzielczość wybrać?
300 DPI to standard i pasuje do większości dokumentów. Weź 150 DPI dla czysto wydrukowanych stron, gdy liczy się szybkość, a 600 DPI dla drobnego druku, umów albo lekko rozmytych skanów.
Co oznacza wskaźnik pewności?
Wskaźnik pewności pokazuje, jak pewne było rozpoznanie na danej stronie. Niska wartość to sygnał, że warto sprawdzić tę stronę dokładniej, na przykład przy kiepskim skanie albo nietypowej czcionce.
Czy moje dokumenty pozostają prywatne?
Samo rozpoznawanie znaków potrzebuje mocy obliczeniowej i działa na serwerze, ale tylko w tym kroku. Twoje dokumenty nie są zapisywane na stałe i nie trafiają do obcych usług.
Czy mogę przetwarzać wielostronicowe skany?
Tak. Narzędzie przetwarza wielostronicowe pliki PDF do 50 MB i pokazuje wynik osobno dla każdej strony, a także jako jeden ciągły tekst.
Podobne narzędzia
Bild-Text-OCR
Rozpoznawaj i wydobywaj tekst z obrazów, skanów i zrzutów ekranu. Niemiecki, angielski, miesz…
PDF zu Bild
Konwertuj strony PDF lokalnie na JPG, PNG lub WebP; AVIF jest przejrzyście kodowany po stroni…
Dokument scannen
Sfotografuj dokumenty telefonem, zaznacz rogi, a serwer je wyprostuje. Skanowanie wsadowe, wz…
PDF bearbeiten
Edytuj pliki PDF prosto w przeglądarce: tekst, zaznaczenia, podkreślenia, przekreślenia, pros…
Chcesz zacząć z PDF-Texterkennung?
Bez instalacji. W cenie od Plus. Otwórz prosto w przeglądarce.
Otwórz teraz