OCR gratuito e local · 21 idiomas · páginas mistas · sem envio

Converter imagem para Markdown (OCR)

Este conversor de imagem para Markdown transforma uma foto ou captura de tela com texto impresso em Markdown sem enviar a imagem para lugar nenhum. O motor de OCR roda dentro do seu navegador, em 21 idiomas, e lê páginas mistas: você escolhe o idioma principal do texto e, se precisar, um segundo idioma, e o inglês é carregado automaticamente junto com as escritas cujos pacotes não conseguem lê-lo sozinhos. A imagem fica no seu aparelho e, depois que o motor e os pacotes usados forem baixados, o conversor continua funcionando off-line.

Imagem → Markdown

Escolha uma imagem com texto impresso

Só no seu navegador
Imagem

Escolha uma foto ou captura de tela que o navegador consiga ler, solte aqui ou cole com Ctrl+V / ⌘V. O LensUp não a envia.

Idioma do texto
Pré-selecionado pelo idioma desta página. Escolha o idioma impresso na página.

Só texto impresso. Uma página pode ter dois idiomas: escolha o principal, adicione um segundo, e o inglês entra nas escritas que precisam dele. Tabelas com linhas viram tabelas Markdown; escrita à mão, tabelas sem linhas, fórmulas e colunas são aproximadas — revise antes de confiar.

Como converter uma imagem para Markdown?

Abra o conversor de imagem para Markdown, escolha uma foto ou captura de tela com texto impresso, confira o idioma do texto e clique em “Reconhecer texto”. O LensUp faz o OCR no seu próprio aparelho — com um segundo idioma se a página misturar dois, e com inglês adicionado às escritas que precisam dele —, transforma parágrafos, marcadores e listas numeradas em blocos Markdown e deixa você corrigir o resultado, copiar ou baixar como .md. A imagem nunca é enviada.

Foi feito para o texto que você quer guardar como anotação, e não como imagem: a página de um livro ou de uma apostila, um slide projetado, o resumo de um quadro escrito em letras de forma, uma receita impressa, o rótulo de um produto, um formulário ou o parágrafo de um cartaz. O texto reconhecido chega como Markdown editável, pronto para o Obsidian, o Notion, uma issue do GitHub ou qualquer caderno em texto puro.

O alcance é estreito de propósito. Ele lê apenas texto impresso, no idioma escolhido mais um segundo opcional; preserva a estrutura que consegue enxergar — parágrafos, listas com marcadores, listas numeradas, títulos maiores e tabelas com linhas — e deixa colunas, escrita à mão e notação matemática como texto aproximado, para conferir linha por linha. Converter imagem para Markdown, imagem para MD, foto para Markdown, print para Markdown, JPG para Markdown, OCR de foto para texto: o nome muda, a tarefa é a mesma, e o resultado é sempre um Markdown que você revisa antes de confiar.

Como converter uma imagem para Markdown

  1. Escolha uma imagemSelecione uma foto ou captura de tela com texto impresso, arraste para a ferramenta ou cole da área de transferência com Ctrl+V / ⌘V. JPG, PNG, WebP, HEIC do iPhone e TIFF são lidos localmente; a página mostra a imagem e o tamanho sem enviar nada.
  2. Confira o idioma e reconheçaEscolha o idioma do texto impresso (o menu pré-seleciona o idioma desta página), adicione um segundo idioma se a página misturar dois e clique em “Reconhecer texto”. Na primeira vez são baixados o motor de OCR (cerca de 1,5 MB) e os pacotes de idioma necessários (0,4 a 3 MB cada); depois ficam em cache. A leitura acontece no seu aparelho, com barra de progresso.
  3. Revise, copie ou baixeO Markdown aparece numa caixa editável ao lado da foto, com a contagem de palavras ou caracteres e a confiança média. Corrija o que o motor leu errado e copie para a área de transferência ou baixe como arquivo .md.

O que vira Markdown, e o que não vira

Cada parágrafo impresso vira um parágrafo Markdown: as quebras de linha são unidas e as palavras separadas por hífen no fim da linha são reconstituídas; linhas em chinês, japonês ou tailandês são unidas sem espaços e contadas em caracteres, não em palavras. Linhas que começam com marcador viram lista; as que começam com 1., 2., 3. — ou com 一、二、三 e 1、2、3 em textos do Leste Asiático — viram lista numerada; e uma linha curta, sozinha, impressa visivelmente maior que o corpo ou toda em maiúsculas, vira um título de segundo nível. Todo o resto permanece texto simples, na ordem de leitura.

Uma tabela desenhada com linhas vira tabela Markdown: a grade é apagada antes do reconhecimento, cada linha impressa vira uma linha da tabela e os vãos que as linhas têm em comum definem as colunas; por isso células mescladas e tabelas sem linha nenhuma saem como linhas de texto. Fórmulas matemáticas não são reconhecidas — frações, expoentes e símbolos saem embaralhados; layouts em duas colunas podem se misturar; escrita à mão, fontes decorativas, letras muito pequenas e texto sobre fundos carregados são lidos mal ou pulados. Números, nomes e códigos merecem uma segunda olhada: um caractere errado ali pesa mais do que num parágrafo. A confiança média mostrada abaixo do resultado é a estimativa do próprio motor, não uma garantia.

Como conseguir uma leitura limpa com a câmera do celular

O reconhecimento óptico de caracteres funciona melhor com a página bem plana, texto nítido, iluminação uniforme e foto tirada de frente, com nitidez parecida com a de uma digitalização a 300 dpi. Preencha o enquadramento com o texto, evite sombras e reflexos e segure firme até o foco travar. Fotos muito grandes são reduzidas para 2600 px no lado maior antes do reconhecimento, o que mantém o texto normal de livros e documentos perfeitamente legível e economiza memória e tempo.

Se a página estiver torta ou com sombra, passe antes pelo scanner do LensUp: a correção de perspectiva e a remoção de sombras produzem uma página plana e de alto contraste, e o JPG ou PNG baixado do scanner é uma ótima entrada aqui. O reconhecedor também aceita capturas de tela, que costumam ser o caso mais fácil de todos.

Quando o motor local não dá conta: corrigir com o Pro

O Tesseract, motor de código aberto por trás da versão gratuita, não lê notação matemática e sofre com tabelas sem linhas ou com células mescladas. Para essas páginas, a caixa de resultado pode oferecer “Corrigir com o Pro” — uma opção paga que aparece quando os pagamentos estão ativos no site: a foto inteira é enviada uma única vez, pelo servidor do LensUp, ao Mathpix — um reconhecedor comercial feito para fórmulas e tabelas — e o Markdown dele substitui o resultado local, com fórmulas em LaTeX entre cifrões e tabelas como tabelas Markdown. O LensUp não armazena a foto durante o processo (o Mathpix a processa segundo os próprios termos); o resultado local fica a um clique.

O Pro é pago por uso justamente para que a versão gratuita continue gratuita e local: enquanto estiver disponível, você entra com um link por e-mail (sem senha), compra 50 usos por um pagamento único de US$ 4,99, sem assinatura, e cada correção com o Pro consome um. Se falhar do lado do fornecedor, nada é descontado.

Idiomas misturados, no seu aparelho, de propósito

A página oferece 21 idiomas: inglês, francês, alemão, espanhol, português, italiano, polonês, turco, indonésio, vietnamita, chinês (simplificado e tradicional), japonês, coreano, russo, árabe, persa, urdu, híndi, bengali e tailandês — os mesmos que o LensUp fala. Cada idioma é um pacote separado, baixado só quando você escolhe: uma página em francês exige o download de um pacote de 0,7 MB e uma em chinês cerca de 1,7 MB, nunca o conjunto inteiro. Escolha o idioma que está de fato impresso e adicione um segundo se a página misturar dois; o pacote de inglês é carregado automaticamente junto com os pacotes de coreano, russo, árabe, persa, urdu, híndi, bengali e tailandês, cujos pacotes transformam palavras em inglês em letras parecidas. Com o pacote errado saem fragmentos em vez de Markdown, a linha de status avisa, e “Detectar o idioma” encontra o pacote certo testando um por sistema de escrita — assim, uma página mista também vira Markdown limpo.

Tudo roda localmente, com um motor de código aberto, do mesmo jeito que o restante do LensUp processa imagens: sem envio, sem conta, sem cópia da sua foto ou do texto em servidor nenhum. Os arquivos do motor e os pacotes são servidos por lensup.ai e guardados em cache pelo navegador, então o segundo reconhecimento num idioma começa na hora. As ferramentas do scanner continuam sem OCR e não geram PDF pesquisável.

Perguntas frequentes

A imagem sai do meu aparelho ao converter uma imagem para Markdown?

Na versão gratuita, não: o motor de OCR e o pacote do idioma escolhido são baixados para o seu navegador e o reconhecimento acontece ali, então nem a foto, nem o texto reconhecido, nem o arquivo .md chegam a um servidor do LensUp. A única exceção é explícita e opcional: quando a caixa de resultado oferece “Corrigir com o Pro” (uma opção paga que aparece com os pagamentos ativos), esse clique envia a foto inteira, pelo LensUp, ao Mathpix (um reconhecedor comercial para fórmulas e tabelas) e traz de volta o Markdown dele; o LensUp não armazena a foto durante o processo (o Mathpix a processa segundo os próprios termos), é preciso entrar com o e-mail e ter usos pagos (50 usos por US$ 4,99, pagamento único), e o resultado local pode ser restaurado.

Quais idiomas o conversor de imagem para Markdown aceita?

Vinte e um idiomas impressos: inglês, francês, alemão, espanhol, português, italiano, polonês, turco, indonésio, vietnamita, chinês (simplificado e tradicional), japonês, coreano, russo, árabe, persa, urdu, híndi, bengali e tailandês. Uma página pode ter dois deles: escolha o principal, adicione um segundo se ela for mista, e o inglês é lido automaticamente junto com coreano, russo, árabe, persa, urdu, híndi, bengali e tailandês, porque esses pacotes sozinhos transformam palavras em inglês em letras parecidas. Letra à mão não é aceita em nenhum idioma.

Por que parte do texto saiu errada ou faltando?

A primeira coisa a conferir é o pacote de idioma: o aviso abaixo do Markdown oferece “Detectar o idioma”, que testa um pacote de OCR por sistema de escrita e fica com o melhor. Depois, a foto: desfoque, reflexo, sombra, inclinação, letra pequena, fontes decorativas e fundos carregados derrubam a qualidade, e tabelas ou páginas em várias colunas podem sair fora de ordem. Refaça a foto com a página plana e bem nítida, ou limpe antes no scanner, e revise o Markdown antes de usar.