Распознавание текста с картинок и PDF

Браузерный OCR-инструмент для извлечения текста из изображений и PDF. Запускает полный движок Tesseract локально через WebAssembly, поддерживает более 100 языков, сам исправляет повёрнутые фото и сканы с тенью, экспортирует в TXT, Word, Excel или PDF с невидимым текстовым слоем для поиска.

Как извлечь текст из изображения или PDF

1
Добавьте файлы

Перетащите изображения или PDF, сфотографируйте с камеры на телефоне, вставьте из буфера по Ctrl+V или укажите URL.

2
Выберите язык

Стандартно распознаются язык сайта и английский; для других документов выберите до трёх языков из сгруппированного списка.

3
Задайте стиль вывода

Простой текст для копирования, «Сохранить разметку» для документов, «Извлечь таблицы» для Excel, «Чек» — для сумм, дат и продавцов.

4
Проверьте и исправьте

Осмотрите рамки, поправьте слова с низкой уверенностью прямо на месте, ищите нужные фрагменты.

5
Экспортируйте

Скачайте как TXT, DOCX, XLSX или PDF с поиском — или упакуйте весь пакет в ZIP.

Превращайте сканы, фото и PDF в редактируемый текст, Word, Excel или PDF с поиском

Перетащите изображения или PDF сюда или выберите

Или нажмите Ctrl+V, чтобы вставить скриншот · вставьте URL

Обработка…

Высокая уверенность Средняя Низкая — проверьте

Кликните по рамке, чтобы перейти к слову · кликните по слову, чтобы подсветить рамку · Редактируйте любое слово прямо в тексте — правки попадут в экспорт.

Обнаружен QR-код:

Экспорт

Работает в вашем браузере через WebAssembly. Офлайн после первого использования.

Горячие клавиши

Ctrl+VВставить изображение из буфера Ctrl+FПоиск в распознанном тексте Ctrl+EnterЗапустить распознавание EscОтменить текущую операцию [ / ]К следующему слову с низкой уверенностью Ctrl+scrollМасштабировать превью
Наведите рамку на документ · держите ровно · нажмите, чтобы сфотографировать
Опубликовано Обновлено Авторы: