Como funciona a conversão de imagem para texto
Solte a foto de um documento, uma captura de tela ou uma página digitalizada e as palavras são reconhecidas e salvas como texto simples que você pode copiar, editar e pesquisar. Isso é OCR, reconhecimento óptico de caracteres, feito pelo Tesseract, o mecanismo de código aberto usado por muitos scanners de documentos, rodando dentro desta aba.
Escolha o idioma do texto antes de converter, entre 64 idiomas: inglês e os principais idiomas europeus, russo, árabe, persa, urdu e hebraico, hindi, bengali, tâmil e as outras grandes escritas indianas, chinês, japonês e coreano (na horizontal ou na vertical), tailandês, vietnamita e outros. Só é baixado o modelo do idioma que você escolher, de cerca de 0.4 MB para o persa a 5.7 MB para o sânscrito e cerca de 3 MB para o inglês, e ele fica em cache para a próxima vez, assim como o mecanismo de OCR de cerca de 4 MB.
Texto impresso nítido em tamanho normal é lido com muita precisão. Os resultados pioram com letra de mão, fontes muito pequenas ou decorativas, pouca luz, desfoque e fotos tiradas em ângulo. O layout não é mantido: a saída são as palavras na ordem de leitura, com quebras de linha, não uma cópia do design da página.
Como o reconhecimento acontece no seu dispositivo, é adequado para recibos, documentos de identidade, cartas e outras imagens que você prefere não enviar.
O arquivo de texto recebe o nome da imagem. Várias imagens podem ser lidas de uma vez, cada uma gerando seu próprio arquivo de texto, o que é ótimo para uma pilha de recibos ou as páginas de um documento fotografado. A precisão é melhor com texto escuro sobre fundo claro, no tamanho de impressão normal ou maior. Capturas de tela de páginas web e documentos são lidas quase perfeitamente, porque o texto já é nítido.
Opções de imagem para texto
| Idiomas | 64, incluindo inglês, espanhol, francês, alemão, russo, árabe, hindi, bengali, chinês, japonês e coreano, com modelos verticais para chinês, japonês e coreano. |
|---|---|
| Saída | Um arquivo de texto simples, UTF-8. |
| Também ler palavras em inglês | Lê com o idioma escolhido e o inglês juntos, para texto misto. |
| Mecanismo | Tesseract, cerca de 4 MB, mais o modelo do idioma escolhido (cerca de 3 MB para o inglês), em cache. |
| Layout | Não é mantido; as palavras saem na ordem de leitura. |
Quando usar
Use o OCR para copiar uma citação de uma captura de tela, pegar o texto de uma carta digitalizada sem redigitar, pesquisar em fotos de anotações, traduzir uma placa ou um cardápio colando o texto em um tradutor ou reaproveitar o texto de uma imagem em um documento.
Recorte a imagem deixando só o texto antes de converter, e tire as fotos de frente e com boa luz. As duas coisas fazem grande diferença na precisão.
Sobre este conversor
Esta página é um atalho para uma das conversões mais comuns, aceitando todo formato de origem que pode ir para o mesmo destino. Ela usa os mesmos mecanismos do resto do site: o ffmpeg compilado para WebAssembly para vídeo e áudio, e o Tesseract para ler texto de imagens, ambos rodando no seu navegador. Os mecanismos são baixados na primeira vez que você clica no botão e ficam em cache para as próximas visitas. Se você sabe os formatos exatos, as páginas específicas, como MP4 para GIF ou JPG para TXT, explicam os detalhes daquele par, mas o resultado desta página é o mesmo.
Solução de problemas de imagem para texto
“Nenhum texto foi reconhecido”
A imagem pode estar borrada, pequena demais ou em outro idioma. Tente uma imagem mais nítida, recorte até o texto e escolha o idioma certo.
As letras saem erradas
Confira a configuração de idioma e tente uma imagem de maior resolução. Fontes decorativas e letra de mão são mais difíceis de ler.
Preciso do texto de um PDF
Se o PDF tiver texto selecionável, use PDF para TXT. Se for uma digitalização, converta antes uma página para JPG e use-a aqui.
Como converter imagem para texto, passo a passo
- Clique em “Escolher imagens” ou arraste os arquivos para a caixa.
- Ajuste as opções se precisar; os padrões servem para a maioria dos usos.
- Clique em “Extrair texto”. O trabalho acontece no seu dispositivo.
- Salve o resultado com o respectivo botão de download.
É seguro fazer isso online?
Na maioria das ferramentas online, “online” significa que seu arquivo é enviado ao servidor de uma empresa, processado lá e guardado por um tempo antes de ser excluído. Aqui não. A página baixa o código da ferramenta para o seu navegador, e seu arquivo é lido e processado dentro da aba, no seu próprio dispositivo. Ele nunca é enviado ao TapToConvert nem a mais ninguém.
Você mesmo pode conferir: depois que a página e o mecanismo carregarem, desligue o Wi-Fi e a ferramenta continua funcionando. Isso também significa que não há fila, nem limite diário, nem limite de tamanho imposto por um servidor; o único limite é a memória que o seu navegador dá a uma única aba.
Perguntas frequentes sobre imagem para texto
A ferramenta de imagem para texto é grátis?
Sim, sem limite de número de imagens.
Consegue ler letra de mão?
Letra de mão caprichada às vezes funciona, mas o Tesseract foi feito para texto impresso, então espere erros.
Quais formatos de imagem funcionam?
JPG, PNG, WebP, HEIC, GIF, BMP, TIFF e AVIF.
Minhas imagens são enviadas?
Não. O reconhecimento roda no seu navegador.
É grátis?
Sim. Sem cadastro, sem marca d'água e sem limite de uso. O TapToConvert é mantido por publicidade.
Meus arquivos são enviados?
Não. Tudo acontece dentro da aba do seu navegador, no seu próprio dispositivo.