Precisa tirar as palavras de uma foto? Seja um recibo escaneado, a foto de um quadro branco, um print de um documento ou a foto de uma placa, o OCR (Reconhecimento Óptico de Caracteres) transforma os pixels da imagem em texto de verdade, que você pode copiar, editar e pesquisar. Este guia explica como usar a ferramenta gratuita Imagem para texto (OCR) deste site. O reconhecimento roda no nosso servidor: seu arquivo é enviado por uma conexão criptografada e apagado assim que o texto é extraído.
O que é OCR?
OCR significa Reconhecimento Óptico de Caracteres. É a tecnologia que analisa uma imagem e identifica o formato de letras, dígitos e sinais de pontuação para produzir texto legível por máquina.
Os mecanismos de OCR modernos usam redes neurais treinadas com milhões de caracteres impressos e manuscritos. Eles reconhecem texto em uma grande variedade de fontes, tamanhos, idiomas e condições de imagem, mesmo com certa inclinação ou um pouco de desfoque.
É o OCR que permite que:
- Bancos digitalizem cheques e documentos de identidade
- O Google Search indexe o texto dentro de imagens
- Os correios leiam endereços escritos à mão nos envelopes
- Arquivistas tornem pesquisáveis milhões de livros escaneados
A mesma tecnologia está disponível aqui, de graça.
Como extrair texto de uma imagem, passo a passo
A ferramenta Imagem para texto (OCR) executa o Tesseract OCR no nosso servidor. Sua imagem é enviada por uma conexão HTTPS criptografada, o texto é extraído e o arquivo enviado é apagado do servidor depois disso.
Passo 1: abra a ferramenta Imagem para texto (OCR)
Acesse want2convert.com/image-to-text. Você verá uma área de envio simples e um seletor de idioma.
Passo 2: envie sua imagem
Arraste e solte a imagem na área de envio ou clique para procurá-la no seu dispositivo. Os formatos aceitos são JPG, PNG, TIFF, BMP, WebP e PDF, com até 50 MB. Para documentos escaneados, use a maior resolução de escaneamento disponível: 300 DPI ou mais dá os melhores resultados.
Passo 3: escolha o idioma (se necessário)
Por padrão, o mecanismo reconhece inglês. A ferramenta também aceita suaíli (kiswahili), francês e árabe: escolha no menu o idioma do texto da sua imagem antes de extrair. Usar o modelo do idioma correto melhora bastante a precisão com caracteres acentuados e padrões de letras específicos de cada idioma. Outros idiomas não são aceitos no momento.
Passo 4: clique em “Extrair texto”
Clique no botão. Seu arquivo é enviado ao nosso servidor, onde é ampliado e convertido para tons de cinza para melhorar o reconhecimento e, em seguida, lido pelo Tesseract. O processamento costuma levar alguns segundos, dependendo do tamanho da imagem e da quantidade de texto; as solicitações expiram após cerca de dois minutos.
Passo 5: copie ou baixe o resultado
O texto extraído aparece em uma área de texto. Você pode:
- Copiar para a área de transferência — cole direto no Word, no Google Docs ou em qualquer editor de texto
- Baixar .txt — salve o resultado como um arquivo
.txt
O que faz uma boa imagem de origem para OCR
A precisão do OCR depende muito da qualidade da imagem de entrada. Veja o que mais faz diferença:
Resolução: O texto precisa de pixels suficientes para ficar legível. Fotos de documentos feitas com o celular, com boa luz e a uma distância razoável (30–50 cm), costumam funcionar bem. A resolução mínima prática para letras pequenas nítidas é de cerca de 150–200 DPI; 300 DPI é o padrão de OCR para escaneamento de arquivo.
Contraste: Texto escuro sobre fundo claro dá o sinal mais nítido para o mecanismo. Tinta desbotada, texto cinza-claro em papel branco ou texto colorido sobre fundo estampado reduzem a precisão.
Nitidez: Imagens borradas, por tremor da câmera ou problemas de foco, são a maior causa de erros de OCR. Apoie o celular em uma superfície estável ao fotografar documentos. Os modos macro do celular funcionam bem para documentos com letras pequenas.
Orientação: Texto muito inclinado ou girado reduz a precisão. O mecanismo lida com uma inclinação pequena (alguns graus), mas páginas fotografadas em ângulo acentuado têm desempenho pior. Use antes a ferramenta Girar imagem para colocar a foto na posição certa, se precisar.
Ruído e sombras: Dobras, sombras sobre a página e texturas de fundo reduzem a precisão. Fotografe os documentos planos, sobre uma mesa de cor clara e com iluminação uniforme.
Precisão: o que o OCR pode e não pode fazer
O OCR é muito preciso em documentos impressos, limpos e de alto contraste, muitas vezes com mais de 99% de caracteres corretos com uma boa entrada. Mesmo assim, a tecnologia tem limites reais que vale conhecer:
| Tipo de entrada | Precisão esperada | |------------|------------------| | Documento impresso escaneado e limpo (300 DPI) | 98–99%+ | | Foto nítida de celular de texto impresso | 90–97% | | Impressão desbotada ou de baixo contraste | 70–85% | | Manuscrito (caprichado e uniforme) | 60–80% | | Manuscrito (cursivo e irregular) | 40–65% | | Fontes muito estilizadas ou logotipos | 30–60% | | Texto em imagem com muito ruído ou fundo | 50–75% |
Para texto impresso em boas condições, espere resultados quase perfeitos. Sempre revise o resultado: um único erro em um número ou nome pode ter consequências reais.
Usos comuns de imagem para texto
Documentos escaneados e PDFs
Os escritórios ainda lidam com montanhas de papel. Quando você recebe um contrato, formulário ou carta escaneado como PDF ou imagem, o OCR o transforma em um documento pesquisável e editável. Depois de extrair o texto, cole no Word ou no Google Docs para editar, ou salve em um arquivo em que você possa pesquisar com Ctrl+F.
Recibos e notas fiscais
Fotografar recibos é um hábito comum para controlar despesas. O OCR extrai os itens, os totais e os nomes dos fornecedores para você colar direto em uma planilha ou relatório de despesas sem digitar tudo de novo.
Cartões de visita
Uma foto rápida de um cartão de visita com o celular, passada pelo OCR, entrega nome, cargo, telefone, e-mail e empresa do contato, prontos para copiar para o seu app de contatos.
Prints de artigos e páginas da web
Se você precisa citar um print ou copiar o texto de um PDF feito de imagens (um livro escaneado, um PDF em que não dá para selecionar texto), o OCR extrai tudo como texto de verdade que você pode usar.
Fotos de quadro branco
Depois de uma reunião, as fotos das anotações do quadro costumam ficar esquecidas na galeria. O OCR as transforma em arquivos de texto ou anotações pesquisáveis.
Digitalização de livros e arquivos
Pesquisadores e genealogistas que escaneiam livros antigos, jornais e registros históricos usam OCR para tornar esses acervos pesquisáveis. O Tesseract, o mecanismo de código aberto usado aqui, é muito empregado em projetos de digitalização de arquivos.
Fluxo de tradução
Extraia primeiro o texto de uma imagem e depois cole em uma ferramenta de tradução. É bem mais rápido do que digitar à mão o texto da foto de um documento, cardápio ou placa em outro idioma.
OCR ou copiar e colar: quando usar cada um
Se você está trabalhando com um PDF digital que tem camada de texto, Ctrl+A + Ctrl+C (selecionar tudo e copiar) é mais rápido e preciso que o OCR. Use o OCR quando:
- O PDF é uma imagem escaneada (sem camada de texto)
- A origem é uma foto ou um print
- O documento não permite selecionar texto (PDFs bloqueados; talvez você também queira desbloqueá-lo antes)
- O texto está em um documento físico, uma placa ou um quadro branco
Perguntas frequentes
A ferramenta de OCR é mesmo grátis?
Sim, totalmente grátis. Sem conta, sem assinatura e sem marca d'água no resultado.
Minhas imagens estão seguras?
Sua imagem ou PDF é enviado ao nosso servidor por uma conexão criptografada (HTTPS), processado lá com o Tesseract OCR e apagado assim que o texto é extraído. Não guardamos cópias e não é preciso ter conta. Como o arquivo é processado em um servidor, evite enviar documentos que você não se sinta à vontade para mandar pela internet.
Quais idiomas são aceitos?
O inglês é o padrão. Você também pode escolher suaíli (kiswahili), francês ou árabe no seletor de idioma. Outros idiomas não são aceitos no momento.
Qual é a precisão?
Para texto impresso limpo e com resolução adequada, a precisão costuma ser muito alta. Para manuscritos ou imagens de baixa qualidade, ela é menor. Sempre revise o resultado em documentos importantes.
Ele consegue ler manuscrito?
O OCR tem reconhecimento limitado de escrita à mão. Funciona melhor com texto impresso, e anotações manuscritas podem dar resultados ruins, principalmente em letra cursiva.
Qual é o tamanho máximo da imagem?
Os envios são limitados a 50 MB e as solicitações expiram após cerca de dois minutos. Imagens muito grandes podem ser lentas; reduzi-las para 2000–3000 pixels de largura com a ferramenta Redimensionar imagem antes do OCR costuma acelerar o processo sem perder precisão.
Posso extrair texto de um PDF?
Sim, você pode enviar um PDF diretamente; as páginas são renderizadas e lidas uma a uma. Se o PDF for grande ou você quiser mais controle, também pode salvar as páginas como JPG ou PNG antes com a ferramenta PDF para JPG e rodar o OCR nas imagens.
Por que alguns caracteres saem errados?
Os erros de OCR vêm, na maioria das vezes, de baixa resolução, desfoque, baixo contraste ou fontes incomuns. Tente melhorar a qualidade da imagem de entrada e rode de novo. Para erros sistemáticos (por exemplo, um l lido como 1), corrija o resultado manualmente depois da extração.
Ferramentas relacionadas
- Redimensionar imagem — amplie uma imagem pequena antes do OCR para melhorar a precisão
- Girar imagem — endireite uma foto inclinada antes do OCR
- PDF para JPG — converta páginas de PDF escaneadas em imagens para o OCR
- Comprimir imagem — reduza o tamanho da imagem sem perder a resolução de que o OCR precisa
- JPG para PNG — converta para PNG para ter qualidade sem perdas antes do OCR em documentos com letras pequenas
- Recortar imagem — isole a área de texto de uma foto antes de rodar o OCR
Experimente grátis — sem cadastro
A maioria das ferramentas roda no seu navegador, então seus arquivos ficam no seu dispositivo. Algumas enviam o arquivo ao nosso servidor e o excluem depois.