Lista de processadores
Mantenha tudo organizado com as coleções
Salve e categorize o conteúdo com base nas suas preferências.
Esta página contém informações detalhadas sobre todos os processadores oferecidos pela
IA de documentos. Pode ver uma lista de todos os processadores por tipo de solução.
Enterprise Document OCR (reconhecimento ótico de carateres)
Descrição
Identificar e extrair texto em diferentes tipos de documentos.
Este processador permite-lhe identificar e extrair texto, incluindo texto escrito à mão, de documentos em mais de 200 idiomas. O processador também usa a aprendizagem automática para fazer uma avaliação da qualidade de um documento com base na legibilidade do respetivo conteúdo.
Versão do modelo congelada v1.0: ficheiros de modelo, configurações e binários de um resumo da versão congelado numa imagem de contentor durante um máximo de 18 meses.
pretrained-ocr-v2.0-2023-06-02
Estável
DG
Modelo pronto para produção especializado em exemplos de utilização de documentos. Inclui acesso a todos os suplementos de OCR.
pretrained-ocr-v2.1-2024-08-07
Estável
DG
As principais áreas de melhoria da versão 2.1 são: melhor reconhecimento de texto impresso, deteção mais precisa de caixas de verificação e ordem de leitura mais precisa.
pretrained-ocr-v2.1.1-2025-01-31
Candidato a lançamento
Pré-visualização pública
A versão 2.1.1 é semelhante à versão 2.1 e está disponível em todas as regiões, exceto: US, EU e asia-southeast1.
A disponibilidade regional encontra-se nos campos US, EU, northamerica-northeast1 e asia-southeast1.
Idiomas suportados
Lista completa de idiomas
Nome do idioma
Etiqueta BCP 47
Script
Escrita manual suportada
Afrikaans
af
Latn
Árabe
ar
Arab
Azeri
az
Latn
Azerbaijano (cirílico)
az-Cyrl
Cyrl
Bielorrusso
be
Cyrl
Búlgaro
bg
Cyrl
Bósnio
bs
Latn
Catalão
ca
Latn
Cebuano
ceb
Latn
Chéquia
cs
Latn
Galês
cy
Latn
Dinamarquês
da
Latn
Alemão
de
Latn
Grego
el
Grek
Inglês
en
Latn
Esperanto
eo
Latn
Espanhol
es
Latn
Estónio
et
Latn
Basco
eu
Latn
Persa
fa
Arab
Finlandês
fi
Latn
Filipino
fil
Latn
Francês
fr
Latn
Irlandês
ga
Latn
Galego
gl
Latn
Hindi
hi
Deva
Croata
hr
Latn
Crioulo haitiano
ht
Latn
Húngaro
hu
Latn
Indonésio
id
Latn
Islandês
is
Latn
Italiano
it
Latn
Hebraico
iw
Hebr
Japonês
ja
Jpan
Javanês
jv
Latn
Cazaque
kk
Cyrl
Coreano
ko
Kore
Quirguize
ky
Cyrl
Latim
la
Latn
Lituânia
lt
Latn
Letão
lv
Latn
Macedónio
mk
Cyrl
Mongol
mn
Cyrl
Marati
mr
Deva
Malaio
ms
Latn
Maltês
mt
Latn
Nepalês
ne
Deva
Neerlandês
nl
Latn
Norueguês
no
Latn
Polaco
pl
Latn
Pastó
ps
Arab
Português (Portugal e Brasil)
pt
Latn
Romeno
ro
Latn
Russo
ru
Cyrl
Russo (ortografia petrina)
ru-PETR1708
Cyrl
Sânscrito
sa
Deva
Eslovaco
sk
Latn
Esloveno
sl
Latn
Albanês
sq
Latn
Sérvio
sr
Cyrl
Sueco
sv
Latn
Suaíli
sw
Latn
Tagalo
tl
Latn
Turco
tr
Latn
Ucraniano
uk
Cyrl
Urdu
ur
Arab
Usbeque
uz
Latn
Usbeque (cirílico)
uz-Cyrl
Cyrl
Vietnamita
vi
Latn
Iídiche
yi
Hebr
Chinês (simplificado)
zh-Hans
Hani
Chinês (tradicional)
zh-Hant
Hani
Zulu
zu
Latn
Versões do processador
ID da versão
Libertar Canal
Nível de maturidade do lançamento
Descrição
pretrained-foundation-model-v1.4-2025-02-05
Estável
DG
Modelo de disponibilidade geral com tecnologia do MDL/CE Gemini 2.0 Flash. Também inclui funcionalidades de OCR avançadas, como a deteção de caixas de verificação.
pretrained-foundation-model-v1.5-2025-05-05
Estável
DG
Candidato pronto para produção com tecnologia do MDL/CE Gemini 2.5 Flash. Recomendado para quem quer experimentar modelos mais recentes.
pretrained-foundation-model-v1.5-pro-2025-06-20
Estável
DG
Modelo pronto para produção com tecnologia do MDL/CE Gemini 2.5 Pro. Suporta uma quota de até 30 páginas por minuto para pedidos de processos online. Este modelo tem uma qualidade melhorada em comparação com a v1.5 e pode ter uma latência mais elevada.
pretrained-foundation-model-v1.5.1-2025-08-07
Candidato a lançamento
Pré-visualização pública
Modelo de pré-visualização pública com tecnologia do MDL/CE Gemini 2.5 Flash. Este modelo tem as mesmas funcionalidades que a v1.5 e um melhor desempenho na aprendizagem adaptável com poucos exemplos.
Extraia pares de chave-valor gerais (entidade e caixa de verificação), tabelas e entidades genéricas de documentos, além do texto de OCR.
Este processador aplica tecnologias de aprendizagem automática avançadas para extrair pares de chave-valor, caixas de verificação e tabelas de documentos em mais de 200 idiomas. Este processador também tira partido de modelos de aprendizagem profunda para extrair 11 entidades genéricas comuns em vários tipos de documentos.
Categoria
Extrair
Funções
OCR, análise de formulários e extração de entidades
Extrai elementos de conteúdo de documentos (texto, tabelas e listas) e cria blocos sensíveis ao contexto.
O Layout Parser extrai elementos de conteúdo de documentos, como texto, tabelas e listas, e cria blocos sensíveis ao contexto que facilitam a obtenção de informações em aplicações de IA generativa e descoberta.
Este analisador suporta ficheiros PDF, HTML, DOCX, PPTX e XLSX/XLSM.
Idiomas suportados
Lista completa de idiomas
Nome do idioma
Etiqueta BCP 47
Script
Escrita manual suportada
Afrikaans
af
Latn
Albanês
sq
Latn
Árabe
ar
Arab
Arménio
hy
Armn
Bielorrusso
be
Cyrl
Bengali
bn
Beng
Bengali
bn
Beng
Búlgaro
bg
Cyrl
Catalão
ca
Latn
Chinês
zh
Hani
Croata
hr
Latn
Chéquia
cs
Latn
Dinamarquês
da
Latn
Neerlandês
nl
Latn
Inglês
en
Latn
Estónio
et
Latn
Filipino
fil
Latn
Finlandês
fi
Latn
Francês
fr
Latn
Alemão
de
Latn
Grego
el
Grek
Gujarati
gu
Gujr
Hebraico
iw
Hebr
Hindi
hi
Deva
Húngaro
hu
Latn
Islandês
is
Latn
Indonésio
id
Latn
Italiano
it
Latn
Japonês
ja
Jpan
Canará
kn
Knda
Khmer
km
Khmr
Coreano
ko
Kore
Laosiano
lo
Laoo
Letão
lv
Latn
Lituânia
lt
Latn
Macedónio
mk
Cyrl
Malaio
ms
Latn
Malaiala
ml
Mlym
Marati
mr
Deva
Nepalês
ne
Deva
Norueguês
no
Latn
Persa
fa
Arab
Polaco
pl
Latn
Português (Portugal e Brasil)
pt
Latn
Punjabi
pa
Guru
Romeno
ro
Latn
Russo
ru
Cyrl
Sérvio
sr
Cyrl
Eslovaco
sk
Latn
Esloveno
sl
Latn
Espanhol
es
Latn
Sueco
sv
Latn
Tagalo
tl
Latn
Tamil
ta
Taml
Telugu
te
Telu
Tailandês
th
Thai
Turco
tr
Latn
Ucraniano
uk
Cyrl
Vietnamita
vi
Latn
Iídiche
yi
Hebr
Versões do processador
ID da versão
Libertar Canal
Nível de maturidade do lançamento
Descrição
pretrained-layout-parser-v1.0-2024-06-03
Estável
DG
Versão de disponibilidade geral para a análise do esquema de documentos. Esta é a versão do processador pré-formado predefinida.
pretrained-layout-parser-v1.5-2025-08-25
Candidato a lançamento
Pré-visualização pública
Versão de pré-visualização com tecnologia do MDG Gemini 2.5 Flash para uma melhor análise do esquema em ficheiros PDF. Recomendado para quem quer experimentar novas versões. Se for usado para ficheiros que não sejam PDF, tem o mesmo comportamento que o pretrained-layout-parser-v1.0-2024-06-03 estável.
pretrained-layout-parser-v1.5-pro-2025-08-25
Candidato a lançamento
Pré-visualização pública
Versão de pré-visualização com tecnologia do MDG Gemini 2.5 Pro para uma melhor análise do esquema em ficheiros PDF. A versão 1.5-pro tem uma latência superior à versão 1.5. Se for usado para ficheiros que não sejam PDF, tem o mesmo comportamento que a versão 1.0 estável.