Погляд усередину
Цей безпечний перегляд показує, для чого потрібен інструмент, не виконуючи дій, що потребують акаунта.
Що вміє Розпізнавання тексту в PDF
Відсканований PDF це, по суті, фотографія. Оку він здається текстом, а комп'ютер бачить лише пікселі: нічого не виділити, не скопіювати, не знайти. OCR (оптичне розпізнавання символів) розв'язує цю проблему: вона знаходить літери на зображенні й перетворює їх на справжній текст, у якому можна шукати. Саме це робить PDF-Texterkennung, сторінка за сторінкою й з попереднім переглядом, щоб було видно, що розпізнано.
Головний фокус на німецьких листах від відомств і фінансових документах. Steuerbescheide, листи від відомств, договори, свідоцтва, рахунки: усе це часто приходить у вигляді скану, і найбільше дратує тоді, коли цифри й строки з нього треба використати далі. Готові шаблони підбирають мову й роздільність під кожен тип документа, щоб не доводилося гаяти час на налаштування.
Розпізнавання працює німецькою, англійською або в змішаному режимі. Німецькі тексти з умлаутами й літерою ß особливо виграють, коли обрано правильну мову. Для документів, де змішано обидві мови, є комбінований режим: він використовує обидва словники одночасно.
Роздільність визначає точність і швидкість. 150 DPI це швидко, і цього досить для чистих, чітко надрукованих сторінок. 300 DPI це стандарт для більшості документів. 600 DPI видобуває максимум із дрібного шрифту, договорів або трохи розмитих сканів, але триває довше. До кожної сторінки ти отримуєш рівень впевненості, який показує, наскільки певним було розпізнавання.
Результат можна переглянути посторінково або як суцільний текст, пошукати в ньому просто в браузері й забрати розпізнаний текст: він готовий до подальшого використання, наприклад, щоб перенести цифру в калькулятор або строк у Fristenwächter. Кількість слів і символів на кожній сторінці завжди перед очима.
Саме розпізнавання символів потребує обчислювальної потужності, тому працює на сервері, але лише на цьому кроці. Твої документи не зберігаються постійно. Без підписки заради простого скану, без обхідного шляху через іноземну хмарну службу з незрозумілими умовами захисту даних.
Функції
Посторінкове розпізнавання
Кожна сторінка розпізнається окремо й показується з мініатюрою, щоб можна було порівняти текст з оригіналом.
Німецька, англійська або обидві
Обери мову, що відповідає документу. Комбінований режим використовує обидва словники одночасно.
Шаблони для листів від відомств
Лист від відомства, Steuerbescheid, договір або рахунок: для кожного своя мова й роздільність.
Три рівні роздільності
150 DPI для швидкості, 300 DPI стандарт, 600 DPI для дрібного шрифту й складних сканів.
Рівні впевненості для сторінок
Показник на кожній сторінці говорить, наскільки певним було розпізнавання, тож ти знаєш, де варто перевірити.
Повнотекстовий пошук
Шукай у розпізнаному тексті просто в браузері й одразу знаходь цифру, ім'я чи строк.
Забрати текст
Дивись результат посторінково або суцільним текстом і бери текст для подальшої роботи.
Як це працює
- 1
Додати відсканований PDF
Обери відсканований документ. Навіть багатосторінкові скани до 50 MB не проблема.
- 2
Обрати мову й якість
Німецька, англійська або обидві, а ще роздільність. Шаблон на кшталт Steuerbescheid налаштовує обидва параметри.
- 3
Почати розпізнавання
Текст розпізнається сторінка за сторінкою. До кожної сторінки ти бачиш перегляд, рівень впевненості й обсяг тексту.
- 4
Знайти й забрати
Шукай у тексті, перевір сумнівні місця й забери результат для подальшої роботи.
Кому це потрібно
Поширені запитання
Що таке OCR?
OCR означає оптичне розпізнавання символів. Вона знаходить літери на зображенні чи у відсканованому PDF і перетворює їх на справжній текст, у якому можна шукати і який можна копіювати. Так фотографія тексту знову стає текстом, з яким працює комп'ютер.
Чи розпізнає інструмент німецькі умлаути?
Так. Обери німецьку мову, і ä, ö, ü та ß розпізнаються правильно. Для документів, де змішано німецьку й англійську, є комбінований режим.
Яку роздільність обрати?
300 DPI це стандарт, він підходить для більшості документів. Бери 150 DPI для чисто надрукованих сторінок, коли треба швидко, і 600 DPI для дрібного шрифту, договорів або трохи розмитих сканів.
Що означає рівень впевненості?
Рівень впевненості показує, наскільки певним було розпізнавання на сторінці. Низьке значення підказує, що цю сторінку варто перевірити уважніше, наприклад, коли скан поганий або шрифт незвичний.
Чи залишаються мої документи приватними?
Саме розпізнавання символів потребує обчислювальної потужності й працює на сервері, але лише на цьому кроці. Твої документи не зберігаються постійно й не передаються стороннім службам.
Чи можна обробляти багатосторінкові скани?
Так. Інструмент обробляє багатосторінкові PDF до 50 MB і показує результат окремо для кожної сторінки та суцільним текстом.
Схожі інструменти
Розпізнавання тексту на зображенні
Розпізнавай і витягуй текст із зображень, сканів і скриншотів. Німецька, англійська, змішаний…
PDF у зображення
Конвертуй сторінки PDF локально в JPG, PNG або WebP; AVIF прозоро кодується на сервері. DPI т…
Сканувати документ
Сфотографуй документи телефоном, познач кути, вирівнювання зробить сервер. Пакетне сканування…
Редагування PDF
Редагуй файли PDF прямо в браузері: текст, виділення, підкреслення, закреслення, прямокутники…
Починаємо з Розпізнавання тексту в PDF?
Без встановлення. Входить від Plus. Відкривається прямо в браузері.
Відкрити зараз