want2convertwant2convert
Меню
Все статьи

Изображение в текст: распознать текст с любого фото бесплатно (OCR онлайн)

7 мин чтенияБесплатно · Без регистрации

Нужно достать слова из фотографии? Будь то отсканированный чек, снимок доски, скриншот документа или фото вывески, OCR (Optical Character Recognition, оптическое распознавание символов) превращает пиксели изображения в настоящий текст, который можно копировать, редактировать и искать. В этом руководстве рассказано, как пользоваться бесплатным инструментом Изображение в текст (OCR) на этом сайте. Распознавание выполняется на нашем сервере: ваш файл передаётся по зашифрованному соединению и удаляется сразу после извлечения текста.


Что такое OCR?

OCR расшифровывается как Optical Character Recognition, то есть оптическое распознавание символов. Это технология, которая анализирует изображение и определяет формы букв, цифр и знаков препинания, чтобы получить текст, понятный машине.

Современные движки OCR используют нейросети, обученные на миллионах печатных и рукописных символов. Они распознают текст в самых разных шрифтах, размерах, языках и условиях съёмки, даже при небольшом наклоне или лёгкой размытости.

Благодаря OCR:

  • банки оцифровывают чеки и документы, удостоверяющие личность
  • Google Search индексирует текст внутри изображений
  • почтовые службы читают рукописные адреса на конвертах
  • архивисты делают поисковыми миллионы отсканированных книг

Та же технология доступна здесь бесплатно.


Как извлечь текст из изображения, шаг за шагом

Инструмент Изображение в текст (OCR) запускает Tesseract OCR на нашем сервере. Ваше изображение загружается по зашифрованному соединению HTTPS, текст извлекается, а загруженный файл после этого удаляется с сервера.

Шаг 1: откройте инструмент Изображение в текст (OCR)

Перейдите на want2convert.com/image-to-text. Вы увидите простую область загрузки и выбор языка.

Шаг 2: загрузите изображение

Перетащите изображение в область загрузки или нажмите, чтобы выбрать его на устройстве. Поддерживаются форматы JPG, PNG, TIFF, BMP, WebP и PDF, размером до 50 МБ. Для сканов документов используйте максимальное доступное разрешение: 300 DPI и выше даёт лучшие результаты.

Шаг 3: выберите язык (если нужно)

По умолчанию движок распознаёт английский. Инструмент также поддерживает суахили (кисуахили), французский и арабский: перед извлечением выберите в списке язык текста на вашем изображении. Правильная языковая модель заметно повышает точность для букв с диакритикой и характерных для языка сочетаний букв. Другие языки пока не поддерживаются.

Шаг 4: нажмите «Извлечь текст»

Нажмите кнопку. Ваш файл отправляется на наш сервер, где его увеличивают и переводят в оттенки серого для лучшего распознавания, а затем читает Tesseract. Обработка обычно занимает несколько секунд в зависимости от размера изображения и плотности текста; запросы прерываются по тайм-ауту примерно через две минуты.

Шаг 5: скопируйте или скачайте результат

Извлечённый текст появится в текстовом поле. Вы можете:

  • Копировать в буфер обмена — вставьте текст прямо в Word, Google Docs или любой текстовый редактор
  • Скачать .txt — сохраните результат в файл .txt

Каким должно быть хорошее исходное изображение для OCR

Точность OCR сильно зависит от качества исходного изображения. Вот что влияет сильнее всего:

Разрешение: Чтобы текст был читаемым, нужно достаточно пикселей. Фото документов на телефон при хорошем освещении и с разумного расстояния (30–50 см) обычно получаются хорошо. Минимальное практическое разрешение для чёткого мелкого шрифта — около 150–200 DPI; 300 DPI — стандарт OCR для архивного сканирования.

Контраст: Тёмный текст на светлом фоне даёт движку самый чёткий сигнал. Выцветшие чернила, светло-серый текст на белой бумаге или цветной текст на узорчатом фоне снижают точность.

Резкость: Размытые изображения из-за дрожания камеры или проблем с фокусом — главная причина ошибок OCR. Снимая документы, ставьте телефон на устойчивую поверхность. Режим макросъёмки на телефоне хорошо подходит для документов с мелким шрифтом.

Ориентация: Сильно наклонённый или повёрнутый текст снижает точность. Движок справляется с небольшим перекосом (несколько градусов), но страницы, снятые под большим углом, распознаются хуже. При необходимости сначала поверните фото как надо с помощью инструмента Повернуть картинку.

Шум и тени: Сгибы, тени на странице и текстуры фона снижают точность. Фотографируйте документы плоско лежащими на светлом столе при ровном освещении.


Точность: что OCR умеет, а что нет

OCR очень точен на чистых контрастных печатных документах: при хорошем исходнике часто более 99% символов распознаются верно. Но у технологии есть реальные ограничения, которые стоит знать:

| Тип исходника | Ожидаемая точность | |------------|------------------| | Чистый отсканированный печатный документ (300 DPI) | 98–99%+ | | Чёткое фото печатного текста на телефон | 90–97% | | Выцветшая или малоконтрастная печать | 70–85% | | Рукописный текст (аккуратный, ровный) | 60–80% | | Рукописный текст (курсив, непостоянный почерк) | 40–65% | | Очень стилизованные шрифты или логотипы | 30–60% | | Текст на изображении с сильными шумами или фоном | 50–75% |

Для печатного текста в хороших условиях ожидайте почти безупречного результата. Всегда вычитывайте итог: одна ошибка в числе или имени может иметь реальные последствия.


Типичные случаи использования «изображения в текст»

Отсканированные документы и PDF

В офисах до сих пор горы бумаги. Когда вам присылают отсканированный договор, форму или письмо в виде PDF или изображения, OCR превращает их в документ, по которому можно искать и который можно редактировать. После извлечения вставьте текст в Word или Google Docs для редактирования или сохраните в файл, где можно искать через Ctrl+F.

Чеки и счета

Фотографировать чеки — привычный способ вести учёт расходов. OCR извлекает позиции, итоги и названия продавцов, чтобы вы могли вставить их сразу в таблицу или отчёт о расходах без перепечатывания.

Визитки

Быстрое фото визитки на телефон, пропущенное через OCR, даёт имя контакта, должность, телефон, электронную почту и компанию, которые остаётся скопировать в приложение контактов.

Скриншоты статей и веб-страниц

Если нужно процитировать скриншот или скопировать текст из PDF, состоящего из картинок (отсканированная книга, PDF с невыделяемым текстом), OCR извлечёт его как настоящий текст, с которым можно работать.

Фото досок

После совещания фотографии заметок с доски часто лежат в галерее без дела. OCR превращает их в текстовые файлы или заметки, по которым можно искать.

Оцифровка книг и архивов

Исследователи и генеалоги, сканирующие старые книги, газеты и исторические записи, используют OCR, чтобы по этим архивам можно было искать. Tesseract, движок с открытым исходным кодом, который используется здесь, широко применяется в проектах оцифровки архивов.

Перевод

Сначала извлеките текст из изображения, потом вставьте его в переводчик. Это намного быстрее, чем перепечатывать вручную текст с фото документа, меню или вывески на иностранном языке.


OCR или копирование и вставка: когда что использовать

Если вы работаете с цифровым PDF, в котором есть текстовый слой, Ctrl+A + Ctrl+C (выделить всё, копировать) быстрее и точнее, чем OCR. Используйте OCR, когда:

  • PDF — это отсканированное изображение (нет текстового слоя)
  • источник — фото или скриншот
  • документ не позволяет выделять текст (защищённые PDF, хотя, возможно, сначала стоит и снять защиту)
  • текст находится на бумажном документе, вывеске или доске

Часто задаваемые вопросы

OCR-инструмент действительно бесплатный?
Да, полностью бесплатный. Без аккаунта, без подписки, без водяных знаков на результате.

Мои изображения в безопасности?
Ваше изображение или PDF отправляется на наш сервер по зашифрованному соединению (HTTPS), обрабатывается там с помощью Tesseract OCR и удаляется сразу после извлечения текста. Мы не храним копии, и аккаунт не нужен. Поскольку файл обрабатывается на сервере, не загружайте документы, которые вы не готовы отправлять через интернет.

Какие языки поддерживаются?
По умолчанию используется английский. Вы также можете выбрать суахили (кисуахили), французский или арабский в списке языков. Другие языки пока не поддерживаются.

Насколько он точен?
Для чистого печатного текста с достаточным разрешением точность обычно очень высокая. Для рукописного текста и изображений плохого качества она ниже. В важных документах всегда вычитывайте результат.

Умеет ли он читать рукописный текст?
Распознавание рукописного текста в OCR ограничено. Лучше всего он работает с печатным текстом, а рукописные заметки могут давать плохой результат, особенно курсив.

Какой максимальный размер изображения?
Размер загрузки ограничен 50 МБ, а запросы прерываются по тайм-ауту примерно через две минуты. Очень большие изображения могут обрабатываться медленно; уменьшение их до 2000–3000 пикселей по ширине с помощью инструмента Изменить размер изображения перед OCR часто ускоряет работу без потери точности.

Можно ли извлечь текст из PDF?
Да, можно загрузить PDF напрямую; его страницы обрабатываются и читаются по одной. Если PDF большой или вы хотите больше контроля, можно сначала сохранить страницы в JPG или PNG с помощью инструмента PDF в JPG и запустить OCR на изображениях.

Почему некоторые символы распознаны неверно?
Ошибки OCR чаще всего вызваны низким разрешением, размытостью, низким контрастом или необычными шрифтами. Попробуйте улучшить качество исходного изображения и запустить заново. Для систематических ошибок (например, когда l читается как 1) исправьте результат вручную после извлечения.


Похожие инструменты

  • Изменить размер изображения — увеличьте маленькое изображение перед OCR, чтобы повысить точность
  • Повернуть картинку — выровняйте наклонённое фото перед OCR
  • PDF в JPG — преобразуйте страницы отсканированного PDF в изображения для OCR
  • Сжать фото — уменьшите размер изображения, не теряя разрешения, нужного для OCR
  • JPG в PNG — преобразуйте в PNG для качества без потерь перед OCR документов с мелким шрифтом
  • Обрезать фото — выделите область с текстом на фото, прежде чем запускать OCR

Попробуйте бесплатно — регистрация не нужна

Большинство инструментов работает в вашем браузере, поэтому файлы остаются на вашем устройстве. Некоторые загружают файл на наш сервер и затем удаляют его.

Все инструменты