Lista de funcionalidades

Atualmente, a API Vision permite-lhe usar as seguintes funcionalidades:

Todos os tipos de funcionalidades

Deteção de texto

Imagem de sinal de trânsito
  • Reconhecimento ótico de carateres (OCR) para uma imagem; reconhecimento de texto e conversão em texto codificado por máquina. Identifica e extrai texto UTF-8 numa imagem.
  • Imagens: otimizadas para áreas esparsas de texto numa imagem maior.
  • Resposta: devolve uma lista de palavras identificadas com texto, caixas delimitadoras e textAnnotations, bem como a hierarquia estrutural do texto detetado pelo OCR (fullTextAnnotation).
    • Hierarquia da estrutura do texto extraído:
      • TextAnnotation -> Page -> Block -> Paragraph -> Word -> Symbol.
      • Cada componente estrutural de Page on pode ter ainda as suas próprias propriedades, como idiomas detetados, quebras, etc.
  • Idiomas suportados: funciona com os idiomas atualmente suportados, mapeados e experimentais.
  • Valor enum do elemento: TEXT_DETECTION.

Deteção de texto em documentos (texto denso / escrita manual)

Imagem densa com anotações
imagem de escrita manual
  • Reconhecimento ótico de carateres (OCR) para um ficheiro (PDF/TIFF) ou uma imagem de texto densa; reconhecimento de texto denso e conversão em texto codificado por máquina.
  • Ficheiros: otimizado para ficheiros de documentos (PDF/TIFF).
  • Imagens: otimizadas para áreas densas de texto numa imagem (imagens que são documentos) e imagens que contêm escrita manual.
  • Resposta: devolve a hierarquia estrutural do texto detetado pelo OCR (fullTextAnnotation).
    • Hierarquia da estrutura do texto extraído:
      • TextAnnotation -> Page -> Block -> Paragraph -> Word -> Symbol.
      • Cada componente estrutural de Page on pode ter ainda as suas próprias propriedades, como idiomas detetados, quebras, etc.
  • Idiomas suportados: funciona com os idiomas atualmente suportados, mapeados e experimentais.
  • Valor enum do elemento: DOCUMENT_TEXT_DETECTION.
    • Tem precedência quando são pedidos DOCUMENT_TEXT_DETECTION e TEXT_DETECTION.