Lista de processadores

Esta página contém informações detalhadas sobre todos os processadores oferecidos pela IA de documentos. Pode ver uma lista de todos os processadores por tipo de solução.

Todos os processadores do Document AI cumprem os Termos de Segurança e Tratamento de Dados.

Consulte a documentação sobre a gestão de versões do processador para ver mais detalhes. Além disso, aplicam-se limites específicos do processador, além das quotas e dos limites gerais do produto.

Digitalize texto

Enterprise Document OCR (reconhecimento ótico de carateres)

Descrição

Identificar e extrair texto em diferentes tipos de documentos.

Este processador permite-lhe identificar e extrair texto, incluindo texto escrito à mão, de documentos em mais de 200 idiomas. O processador também usa a aprendizagem automática para fazer uma avaliação da qualidade de um documento com base na legibilidade do respetivo conteúdo.

Categoria Digitalize
Funções OCR, análise de qualidade
Fase de lançamento Disponibilidade geral
Estado de acesso Público
Escreva na API OCR_PROCESSOR
Idiomas suportados
Lista completa de idiomas
Nome do idioma Etiqueta BCP 47 Script Escrita manual suportada
Afrikaans af Latn
Albanês sq Latn
Árabe ar Arab
Arménio hy Armn
Bielorrusso be Cyrl
Bengali bn Beng
Bengali bn Beng
Búlgaro bg Cyrl
Catalão ca Latn
Chinês zh Hani
Croata hr Latn
Chéquia cs Latn
Dinamarquês da Latn
Neerlandês nl Latn
Inglês en Latn
Estónio et Latn
Filipino fil Latn
Finlandês fi Latn
Francês fr Latn
Alemão de Latn
Grego el Grek
Gujarati gu Gujr
Hebraico iw Hebr
Hindi hi Deva
Húngaro hu Latn
Islandês is Latn
Indonésio id Latn
Italiano it Latn
Japonês ja Jpan
Canará kn Knda
Khmer km Khmr
Coreano ko Kore
Laosiano lo Laoo
Letão lv Latn
Lituânia lt Latn
Macedónio mk Cyrl
Malaio ms Latn
Malaiala ml Mlym
Marati mr Deva
Nepalês ne Deva
Norueguês no Latn
Persa fa Arab
Polaco pl Latn
Português (Portugal e Brasil) pt Latn
Punjabi pa Guru
Romeno ro Latn
Russo ru Cyrl
Sérvio sr Cyrl
Eslovaco sk Latn
Esloveno sl Latn
Espanhol es Latn
Sueco sv Latn
Tagalo tl Latn
Tamil ta Taml
Telugu te Telu
Tailandês th Thai
Turco tr Latn
Ucraniano uk Cyrl
Vietnamita vi Latn
Iídiche yi Hebr
Versões do processador
ID da versão Libertar Canal Nível de maturidade do lançamento Descrição
pretrained-ocr-v1.2-2022-11-10 Estável DG Versão do modelo congelada v1.0: ficheiros de modelo, configurações e binários de um resumo da versão congelado numa imagem de contentor durante um máximo de 18 meses.
pretrained-ocr-v2.0-2023-06-02 Estável DG Modelo pronto para produção especializado em exemplos de utilização de documentos. Inclui acesso a todos os suplementos de OCR.
pretrained-ocr-v2.1-2024-08-07 Estável DG As principais áreas de melhoria da versão 2.1 são: melhor reconhecimento de texto impresso, deteção mais precisa de caixas de verificação e ordem de leitura mais precisa.
pretrained-ocr-v2.1.1-2025-01-31 Candidato a lançamento Pré-visualização pública A versão 2.1.1 é semelhante à versão 2.1 e está disponível em todas as regiões, exceto: US, EU e asia-southeast1.

Para mais informações, consulte o artigo Gerir versões do processador.

Quotas e limites
Número máximo de páginas (pedidos online/síncronos): 15
Número máximo de páginas (pedidos em lote/offline/assíncronos): 500
Número máximo de páginas (modo sem imagens online/pedidos síncronos): 30
Uptraining
Ficheiro de entrada de exemplo Abrir numa nova janela.
Exemplo de saída Abrir numa nova janela.
Regiões suportadas
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
Mais informações Enterprise Document OCR

Extraia entidades de documentos

Consulte os conjuntos de dados de exemplo para ver exemplos de conjuntos de dados etiquetados e não etiquetados a usar para a preparação.

Extrator personalizado

Descrição

Extraia campos de documentos com IA generativa ou modelos personalizados; ajuste os modelos para extrair dados com precisão dos seus documentos.

Categoria Extrair
Funções OCR, extração de entidades
Fase de lançamento Disponibilidade geral
Estado de acesso Público
Escreva na API CUSTOM_EXTRACTION_PROCESSOR
Notes
  • Se usar a IA generativa para extração:

    • Apenas o idioma inglês é oficialmente suportado.
    • A disponibilidade regional encontra-se nos campos US, EU, northamerica-northeast1 e asia-southeast1.

Idiomas suportados
Lista completa de idiomas
Nome do idioma Etiqueta BCP 47 Script Escrita manual suportada
Afrikaans af Latn
Árabe ar Arab
Azeri az Latn
Azerbaijano (cirílico) az-Cyrl Cyrl
Bielorrusso be Cyrl
Búlgaro bg Cyrl
Bósnio bs Latn
Catalão ca Latn
Cebuano ceb Latn
Chéquia cs Latn
Galês cy Latn
Dinamarquês da Latn
Alemão de Latn
Grego el Grek
Inglês en Latn
Esperanto eo Latn
Espanhol es Latn
Estónio et Latn
Basco eu Latn
Persa fa Arab
Finlandês fi Latn
Filipino fil Latn
Francês fr Latn
Irlandês ga Latn
Galego gl Latn
Hindi hi Deva
Croata hr Latn
Crioulo haitiano ht Latn
Húngaro hu Latn
Indonésio id Latn
Islandês is Latn
Italiano it Latn
Hebraico iw Hebr
Japonês ja Jpan
Javanês jv Latn
Cazaque kk Cyrl
Coreano ko Kore
Quirguize ky Cyrl
Latim la Latn
Lituânia lt Latn
Letão lv Latn
Macedónio mk Cyrl
Mongol mn Cyrl
Marati mr Deva
Malaio ms Latn
Maltês mt Latn
Nepalês ne Deva
Neerlandês nl Latn
Norueguês no Latn
Polaco pl Latn
Pastó ps Arab
Português (Portugal e Brasil) pt Latn
Romeno ro Latn
Russo ru Cyrl
Russo (ortografia petrina) ru-PETR1708 Cyrl
Sânscrito sa Deva
Eslovaco sk Latn
Esloveno sl Latn
Albanês sq Latn
Sérvio sr Cyrl
Sueco sv Latn
Suaíli sw Latn
Tagalo tl Latn
Turco tr Latn
Ucraniano uk Cyrl
Urdu ur Arab
Usbeque uz Latn
Usbeque (cirílico) uz-Cyrl Cyrl
Vietnamita vi Latn
Iídiche yi Hebr
Chinês (simplificado) zh-Hans Hani
Chinês (tradicional) zh-Hant Hani
Zulu zu Latn
Versões do processador
ID da versão Libertar Canal Nível de maturidade do lançamento Descrição
pretrained-foundation-model-v1.4-2025-02-05 Estável DG Modelo de disponibilidade geral com tecnologia do MDL/CE Gemini 2.0 Flash. Também inclui funcionalidades de OCR avançadas, como a deteção de caixas de verificação.
pretrained-foundation-model-v1.5-2025-05-05 Estável DG Candidato pronto para produção com tecnologia do MDL/CE Gemini 2.5 Flash. Recomendado para quem quer experimentar modelos mais recentes.
pretrained-foundation-model-v1.5-pro-2025-06-20 Estável DG Modelo pronto para produção com tecnologia do MDL/CE Gemini 2.5 Pro. Suporta uma quota de até 30 páginas por minuto para pedidos de processos online. Este modelo tem uma qualidade melhorada em comparação com a v1.5 e pode ter uma latência mais elevada.
pretrained-foundation-model-v1.5.1-2025-08-07 Candidato a lançamento Pré-visualização pública Modelo de pré-visualização pública com tecnologia do MDL/CE Gemini 2.5 Flash. Este modelo tem as mesmas funcionalidades que a v1.5 e um melhor desempenho na aprendizagem adaptável com poucos exemplos.

Para mais informações, consulte o artigo Gerir versões do processador.

Quotas e limites
Número máximo de páginas (pedidos online/síncronos): 15
Número máximo de páginas (pedidos em lote/offline/assíncronos): 200
Número máximo de páginas (modo sem imagens online/pedidos síncronos): 30
Tipos de dados normalizados

Pode encontrar mais informações nas páginas Enriquecimento e normalização e Criar conjunto de dados.

Lista completa de tipos de dados normalizados
  • dateTime as STRING
  • currency as STRING
  • money as google.type.Money
  • number as FLOAT or INTEGER
Uptraining
Ficheiro de entrada de exemplo Abrir numa nova janela.
Exemplo de saída Abrir numa nova janela.
Regiões suportadas
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
Mais informações Extrator personalizado

Analisador de formulários

Descrição

Extraia pares de chave-valor gerais (entidade e caixa de verificação), tabelas e entidades genéricas de documentos, além do texto de OCR.

Este processador aplica tecnologias de aprendizagem automática avançadas para extrair pares de chave-valor, caixas de verificação e tabelas de documentos em mais de 200 idiomas. Este processador também tira partido de modelos de aprendizagem profunda para extrair 11 entidades genéricas comuns em vários tipos de documentos.

Categoria Extrair
Funções OCR, análise de formulários e extração de entidades
Fase de lançamento Disponibilidade geral
Estado de acesso Público
Escreva na API FORM_PARSER_PROCESSOR
Idiomas suportados
Lista completa de idiomas
Nome do idioma Etiqueta BCP 47 Script Escrita manual suportada
Afrikaans af Latn
Albanês sq Latn
Árabe ar Arab
Bielorrusso be Cyrl
Catalão ca Latn
Chinês zh Hani
Croata hr Latn
Chéquia cs Latn
Dinamarquês da Latn
Neerlandês nl Latn
Inglês en Latn
Estónio et Latn
Filipino fil Latn
Finlandês fi Latn
Francês fr Latn
Alemão de Latn
Hebraico iw Hebr
Hindi hi Deva
Húngaro hu Latn
Islandês is Latn
Indonésio id Latn
Italiano it Latn
Japonês ja Jpan
Coreano ko Kore
Letão lv Latn
Lituânia lt Latn
Macedónio mk Cyrl
Malaio ms Latn
Marati mr Deva
Nepalês ne Deva
Norueguês no Latn
Persa fa Arab
Polaco pl Latn
Português (Portugal e Brasil) pt Latn
Romeno ro Latn
Russo ru Cyrl
Sérvio sr Cyrl
Eslovaco sk Latn
Esloveno sl Latn
Espanhol es Latn
Sueco sv Latn
Tagalo tl Latn
Turco tr Latn
Ucraniano uk Cyrl
Vietnamita vi Latn
Iídiche yi Hebr
Versões do processador
ID da versão Libertar Canal Maturidade do lançamento Campos adicionais detetados Descrição
pretrained-form-parser-v1.0-2020-09-23 Estável DG

Nenhum

Versão antiga. Para obter a melhor qualidade e o conjunto completo de funcionalidades, use o analisador de formulários v2.0.
pretrained-form-parser-v2.0-2022-11-10 Estável DG
Mostrar campos
  • email
  • phone
  • url
  • date_time
  • address
  • person
  • organization
  • quantity
  • price
  • id
  • page_number
Versão recomendada. Suporta entidades genéricas e inclui um modelo de tabela, KVP e caixa de verificação atualizado, bem como mais de 200 idiomas.
pretrained-form-parser-v2.1-2023-06-26 Candidato a lançamento Pré-visualização pública

Nenhum

Versão de pré-visualização pública. O mesmo modelo que a v2.0 com a extração de texto nativa de ficheiros PDF digitais ativada.

Para mais informações, consulte o artigo Gerir versões do processador.

Quotas e limites
Número máximo de páginas (pedidos online/síncronos): 15
Número máximo de páginas (pedidos em lote/offline/assíncronos): 100
Número máximo de páginas (modo sem imagens online/pedidos síncronos): 30
Uptraining
Ficheiro de entrada de exemplo Abrir numa nova janela.
Exemplo de saída Abrir numa nova janela.
Regiões suportadas
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
Mais informações Form Parser

Analisador de esquemas

Descrição

Extrai elementos de conteúdo de documentos (texto, tabelas e listas) e cria blocos sensíveis ao contexto.

O Layout Parser extrai elementos de conteúdo de documentos, como texto, tabelas e listas, e cria blocos sensíveis ao contexto que facilitam a obtenção de informações em aplicações de IA generativa e descoberta.

Categoria Extrair
Funções Análise de esquemas, divisão de documentos
Fase de lançamento Disponibilidade geral
Estado de acesso Público
Escreva na API LAYOUT_PARSER_PROCESSOR
Notes
  • Este analisador suporta ficheiros PDF, HTML, DOCX, PPTX e XLSX/XLSM.
Idiomas suportados
Lista completa de idiomas
Nome do idioma Etiqueta BCP 47 Script Escrita manual suportada
Afrikaans af Latn
Albanês sq Latn
Árabe ar Arab
Arménio hy Armn
Bielorrusso be Cyrl
Bengali bn Beng
Bengali bn Beng
Búlgaro bg Cyrl
Catalão ca Latn
Chinês zh Hani
Croata hr Latn
Chéquia cs Latn
Dinamarquês da Latn
Neerlandês nl Latn
Inglês en Latn
Estónio et Latn
Filipino fil Latn
Finlandês fi Latn
Francês fr Latn
Alemão de Latn
Grego el Grek
Gujarati gu Gujr
Hebraico iw Hebr
Hindi hi Deva
Húngaro hu Latn
Islandês is Latn
Indonésio id Latn
Italiano it Latn
Japonês ja Jpan
Canará kn Knda
Khmer km Khmr
Coreano ko Kore
Laosiano lo Laoo
Letão lv Latn
Lituânia lt Latn
Macedónio mk Cyrl
Malaio ms Latn
Malaiala ml Mlym
Marati mr Deva
Nepalês ne Deva
Norueguês no Latn
Persa fa Arab
Polaco pl Latn
Português (Portugal e Brasil) pt Latn
Punjabi pa Guru
Romeno ro Latn
Russo ru Cyrl
Sérvio sr Cyrl
Eslovaco sk Latn
Esloveno sl Latn
Espanhol es Latn
Sueco sv Latn
Tagalo tl Latn
Tamil ta Taml
Telugu te Telu
Tailandês th Thai
Turco tr Latn
Ucraniano uk Cyrl
Vietnamita vi Latn
Iídiche yi Hebr
Versões do processador
ID da versão Libertar Canal Nível de maturidade do lançamento Descrição
pretrained-layout-parser-v1.0-2024-06-03 Estável DG Versão de disponibilidade geral para a análise do esquema de documentos. Esta é a versão do processador pré-formado predefinida.
pretrained-layout-parser-v1.5-2025-08-25 Candidato a lançamento Pré-visualização pública Versão de pré-visualização com tecnologia do MDG Gemini 2.5 Flash para uma melhor análise do esquema em ficheiros PDF. Recomendado para quem quer experimentar novas versões. Se for usado para ficheiros que não sejam PDF, tem o mesmo comportamento que o pretrained-layout-parser-v1.0-2024-06-03 estável.
pretrained-layout-parser-v1.5-pro-2025-08-25 Candidato a lançamento Pré-visualização pública Versão de pré-visualização com tecnologia do MDG Gemini 2.5 Pro para uma melhor análise do esquema em ficheiros PDF. A versão 1.5-pro tem uma latência superior à versão 1.5. Se for usado para ficheiros que não sejam PDF, tem o mesmo comportamento que a versão 1.0 estável.

Para mais informações, consulte o artigo Gerir versões do processador.

Quotas e limites
Número máximo de páginas (pedidos online/síncronos): 15
Número máximo de páginas (pedidos em lote/offline/assíncronos): 500
Número máximo de páginas (modo sem imagens online/pedidos síncronos): 30