OCR изображений и PDF (распознавание текста)
Извлекайте текст из фото, сканов и PDF — 11 языков, копирование или скачивание TXT
Серверный FFmpeg обрабатывает любой формат — включая файлы HEVC/H.265, которые ваш браузер не воспроизводит. Файлы удаляются с сервера в течение 30 минут.
⚠️ Не закрывайте и не обновляйте эту страницу до завершения — иначе результат может быть потерян.
💡 Большие файлы едут со скоростью вашего соединения: загрузка продолжается сама и безопасно возобновляется, поэтому медленная сеть влияет только на время — но никогда на ваши кредиты.
Как устроен конвейер распознавания
Оба режима работают на одном серверном движке OCR с разной преднастройкой:
- Режим фото — выпрямляет наклонённые страницы и нормализует экспозицию перед распознаванием; лучший выбор для документов, вывесок и первых попыток распознать рукописный текст.
- Режим скриншотов — сохраняет межбуквенные интервалы в тексте интерфейсов: пузыри сообщений, меню, вывод терминала и пиксельные шрифты остаются читаемыми там, где универсальный OCR их размазывает.
- Языки — более 100 языков через Tesseract с автоматическим определением письменности; смешанные китайско-английские снимки обрабатываются построчно.
- Результат — обычный текст с сохранением порядка чтения, плюс маркеры уверенности на сомнительных словах, которые стоит вычитать вручную.
Два движка OCR — одно рабочее пространство
Режим фото распознаёт кадры с камеры с коррекцией перспективы, а режим скриншотов настроен на интерфейсы чатов, код и игровой текст — выбирайте нужный под задачу, не покидая страницу.
Два режима распознавания
Общий OCR и OCR, ориентированный на скриншоты — в одном инструменте.
Поддержка нескольких языков
Движок распознаёт текст на всех одиннадцати языках сайта.
Распознаёт 11 языков
Загруженные изображения удаляются с сервера после обработки.
Маркеры уверенности
Слова с низкой уверенностью распознавания помечаются отдельно — вы точно знаете, какие места нужно вычитать, вместо того чтобы слепо доверять автоматическому результату.
Как это работает
- 1
Выберите режим «Изображение» или «Скриншот».
- 2
Загрузите изображение, содержащее текст.
- 3
Скопируйте или скачайте распознанный текст.
- 4
Скопируйте распознанный текст прямо на странице или скачайте его файлом TXT в кодировке UTF-8.
Частые вопросы
Можно ли распознать PDF?⌄
Да, оба режима принимают PDF-страницы в качестве входных данных.
Поддерживается ли рукописный текст?⌄
Лучше всего работает с печатным текстом. Распознавание рукописного текста не гарантируется.
Сохраняется ли моё изображение?⌄
Нет. Оно удаляется с сервера сразу после извлечения текста.
Почему рукописный текст часто не распознаётся?⌄
Движок рассчитан на печатный текст. Аккуратные печатные буквы иногда поддаются, но связная рукопись требует отдельной модели распознавания почерка, которой этот инструмент сознательно не располагает.
Похожие инструменты
Что такое OCR-распознавание изображений?
OCR-распознавание изображений превращает фотографии текста в редактируемый и выделяемый текст. Работает со сканированными документами, фото страниц и скриншотами приложений или чатов.
Что вы можете делать
- Извлекать текст из фотографий и сканов
- Распознавать текст на скриншотах и в окнах чатов
- Обрабатывать несколько языков одним движком
Когда это использовать
- Цифровизация бумажных заметок или чеков
- Копирование текста из изображений, где его невозможно выделить
- Превращение скриншотов в редактируемый контент
Изображения загружаются на сервер для распознавания и затем удаляются.