Imagem para texto (OCR)
Transforme uma foto, captura de tela ou scan em texto que você pode copiar e editar — lido inteiramente no seu próprio dispositivo, nada é enviado.
O que o OCR lê bem — e o que ele nunca vai conseguir ler
O reconhecimento de caracteres é reconhecimento de padrões, não compreensão, então o resultado acompanha a entrada com uma honestidade brutal. Uma captura de tela nítida ou uma digitalização plana e bem iluminada de texto impresso sai quase perfeita. Uma foto de celular da mesma página, tirada com um leve ângulo e com uma sombra em um canto, cai visivelmente de qualidade — e escrita à mão, fontes decorativas, texto sobreposto a fotos e impressos de baixo contraste (cinza sobre branco, cor sobre cor) podem sair praticamente inutilizáveis. Três hábitos resolvem a maior parte disso: fotografe de frente, não em ângulo, preencha o quadro com o texto e recorte o entorno, e, quando a fonte já estiver na tela, use a captura de tela original em vez de fotografar o monitor. Cada um desses passos remove uma distorção que, do contrário, o reconhecedor teria de adivinhar.
O download único — e por que ele existe
Na primeira vez que você clicar em Ler texto, o seu navegador baixa o mecanismo de reconhecimento e os dados do idioma inglês — cerca de 7 MB, servidos por este site e armazenados em cache, então as execuções seguintes começam em instantes. Esse download é o preço de uma promessa real: o mecanismo roda inteiramente no seu próprio dispositivo como WebAssembly, o que significa que a foto do seu contrato, receita médica ou holerite nunca é transmitida a lugar nenhum. A maioria dos serviços de OCR online funciona ao contrário — uma página minúscula, e o seu documento enviado ao servidor deles. Se a primeira execução parecer parada por alguns segundos em uma conexão lenta, é porque está baixando, não travada; a linha de progresso indica em qual fase o processo está. Depois dessa primeira visita, o mecanismo carrega direto do cache, e o reconhecimento de uma página comum de texto leva alguns segundos mesmo em um laptop modesto.
Apenas inglês, por enquanto — e sempre revise os números
Esta primeira versão lê texto e números em inglês. Outros idiomas estão previstos — cada um é um arquivo de dados treinado adicional, então vão chegar como downloads separados em vez de um pacote gigante único —, mas hoje uma carta em holandês ou uma fatura em turco sai embaralhada onde quer que as palavras deixem de parecer inglês. Números merecem um alerta especial só para eles: uma leitura errada de 8 por 3 em um IBAN, um número de telefone ou o total de uma fatura custa muito mais caro do que uma palavra lida errado, e dígitos não carregam nenhum contexto de ortografia que o mecanismo possa usar para se corrigir. Seja qual for o texto, leia o resultado uma vez antes de confiar nele; sejam quais forem os números, confira-os duas vezes.
O texto já saiu — agora coloque-o em algum lugar útil
Copiar texto coloca o resultado na sua área de transferência, e a partir daí ele geralmente tem um de três destinos. Direto para um documento ou e-mail é o óbvio — todo o sentido do OCR é nunca mais redigitar uma página. Menos óbvio: cole em /pt/text-to-speech e a página vira áudio, o que transforma um artigo fotografado em algo que você pode ouvir enquanto faz qualquer outra coisa. E quando o que você realmente precisa é da página como um documento compartilhável, e não como texto solto, /pt/image-to-pdf envolve a foto original em um PDF de verdade — mais organizado para arquivar e encaminhar do que uma imagem solta, com esta ferramenta cobrindo os momentos em que você também precisa das palavras.
Como obter o melhor resultado do OCR
O reconhecimento de caracteres funciona melhor em imagens nítidas e bem iluminadas, com texto escuro sobre fundo claro. Fotografe documentos de frente, e não em ângulo, recorte para mostrar só o texto se puder, e prefira a captura de tela original a uma foto de uma tela. No momento lê inglês e números; mais idiomas estão previstos.
Minha imagem é enviada para algum lugar?
Não — o mecanismo de reconhecimento roda dentro do seu navegador (WebAssembly). Sua imagem nunca sai do seu dispositivo, o que também torna isso seguro para documentos que você prefere não compartilhar com um site qualquer.
Por que o primeiro uso demora mais?
No primeiro uso, seu navegador baixa o mecanismo de leitura e os dados do idioma inglês (cerca de 7 MB) deste site. Depois fica em cache, então as conversões seguintes começam bem mais rápido.
Por que algumas palavras saem erradas?
O OCR é uma estimativa de melhor esforço, e borrão, escrita à mão, fontes decorativas ou baixo contraste reduzem a precisão. Sempre revise o resultado — especialmente números.
