Pular para o conteúdo principal

OCR

1. Visão Geral

O componente OCR (ocr) extrai texto de uma imagem usando reconhecimento óptico de caracteres (OCR). É útil para ler documentos escaneados, fotos de comprovantes, capturas de tela com texto, entre outros.

Use quando o fluxo precisa transformar uma imagem em texto pesquisável. Não é indicado para PDFs com texto nativo (nesse caso, o componente PDF Reader é mais adequado, pois lê o texto diretamente sem precisar de OCR).

2. Pré-requisitos

Não há credenciais externas — o reconhecimento de texto roda localmente (motor Tesseract), sem chamadas para serviços externos.

3. Autenticação e Conexão

Não aplicável.

4. Configuração / Operações Suportadas

O componente tem uma única operação: extrair texto de uma imagem.

CampoObrigatórioTipoDescriçãoExemplo
imageSimTextoNome da propriedade da mensagem onde está a imagem."comprovante"
formatNãoTexto: text ou markdownFormato do texto extraído. markdown adiciona quebras de linha compatíveis com Markdown. Valor padrão: "text"."markdown"
languageNãoTextoCódigo do idioma do texto na imagem. Valor padrão: "eng" (inglês)."por" (português)
dpiNãoNúmeroResolução (DPI) informada ao motor de OCR. Valor padrão: 300.300
pageSegModeNãoNúmeroModo de segmentação de página do motor de OCR (controla como o texto é identificado no layout da imagem). Valor padrão: 6.6
blockSizeNãoNúmeroParâmetro técnico do pré-processamento de imagem (binarização). Valor padrão: 15.15
thresholdOffsetNãoNúmeroParâmetro técnico do pré-processamento de imagem (binarização). Valor padrão: 10.10

⚠️ CONFIRMAR: os valores de pageSegMode seguem a numeração padrão do Tesseract (por exemplo, 6 = "bloco uniforme de texto"), mas o código não documenta a tabela completa de valores possíveis.

5. Exemplos Práticos

Exemplo simples: extrair o texto de um comprovante de pagamento em imagem, recebido em português.

Entrada (imagem já anexada por um passo anterior, por exemplo um upload):

{
"comprovante": "<arquivo de imagem, disponibilizado por um passo anterior>"
}

Configuração do componente:

{
"componentName": "ocr",
"configurations": {
"image": "comprovante",
"language": "por"
}
}

Resposta:

{
"text": "COMPROVANTE DE PAGAMENTO\nValor: R$ 150,00\nData: 20/07/2026",
"format": "text",
"language": "por",
"length": 58
}

Exemplo avançado: extrair o texto de uma imagem já em formato Markdown (para exibir preservando quebras de linha), ajustando os parâmetros de pré-processamento para uma imagem de baixa qualidade.

Configuração do componente:

{
"componentName": "ocr",
"configurations": {
"image": "fotoDocumento",
"language": "por",
"format": "markdown",
"blockSize": "25",
"thresholdOffset": "15"
}
}

Resposta:

{
"text": "DOCUMENTO DE IDENTIDADE \nNome: Maria Silva \nCPF: 123.456.789-00",
"format": "markdown",
"language": "por",
"length": 63
}

6. Erros Comuns e Troubleshooting

Erro / SintomaCausa provávelComo resolver
"An image file is required but has not been configured."O campo image não foi preenchido.Preencher image com o nome da propriedade que contém a imagem.
"File [nome] not found inside the execution context."A imagem referenciada não está disponível na mensagem com esse nome.Confirmar que um passo anterior disponibilizou a imagem com esse nome exato.
"Unsupported or corrupted image format"O arquivo enviado não é uma imagem válida ou está corrompido.Verificar se o arquivo é realmente uma imagem em formato suportado (ex.: JPG, PNG).
"OCR processing failed: ..."Falha interna do motor de OCR ao processar a imagem.Tentar com uma imagem de melhor qualidade/resolução, ou revisar os parâmetros de pré-processamento.
Texto extraído com muitos erros/ruídoImagem de baixa qualidade, idioma incorreto configurado, ou parâmetros de pré-processamento inadequados para o tipo de imagem.Ajustar language para o idioma correto do texto e testar diferentes valores de blockSize/thresholdOffset.