Распознавание текста с картинок и PDF
Браузерный OCR-инструмент для извлечения текста из изображений и PDF. Запускает полный движок Tesseract локально через WebAssembly, поддерживает более 100 языков, сам исправляет повёрнутые фото и сканы с тенью, экспортирует в TXT, Word, Excel или PDF с невидимым текстовым слоем для поиска.
Как извлечь текст из изображения или PDF
Перетащите изображения или PDF, сфотографируйте с камеры на телефоне, вставьте из буфера по Ctrl+V или укажите URL.
Стандартно распознаются язык сайта и английский; для других документов выберите до трёх языков из сгруппированного списка.
Простой текст для копирования, «Сохранить разметку» для документов, «Извлечь таблицы» для Excel, «Чек» — для сумм, дат и продавцов.
Осмотрите рамки, поправьте слова с низкой уверенностью прямо на месте, ищите нужные фрагменты.
Скачайте как TXT, DOCX, XLSX или PDF с поиском — или упакуйте весь пакет в ZIP.
Превращайте сканы, фото и PDF в редактируемый текст, Word, Excel или PDF с поиском
Перетащите изображения или PDF сюда или выберите
Или нажмите Ctrl+V, чтобы вставить скриншот · вставьте URL
Обработка…
Кликните по рамке, чтобы перейти к слову · кликните по слову, чтобы подсветить рамку · Редактируйте любое слово прямо в тексте — правки попадут в экспорт.