Liste des sous-traitants

Cette page contient des informations détaillées sur tous les processeurs proposés par Document AI. Vous pouvez afficher la liste de tous les processeurs par type de solution.

Tous les processeurs Document AI respectent les Conditions relatives à la sécurité et au traitement des données.

Pour en savoir plus, consultez la documentation sur la gestion des versions de l'outil de traitement. De plus, des limites de processeur spécifiques s'appliquent en plus des quotas et limites généraux du produit.

Numériser du texte

Enterprise Document OCR (reconnaissance optique des caractères)

Description

Identifiez et extrayez du texte dans différents types de documents.

Ce processeur vous permet d'identifier et d'extraire le texte, y compris le texte manuscrit, des documents dans plus de 200 langues. Le processeur utilise également le machine learning pour évaluer la qualité d'un document en fonction de la lisibilité de son contenu.

Catégorie Numériser
Fonctions OCR, analyse de la qualité
Phase de version Disponibilité générale
État de l'accès Public
Saisir l'API OCR_PROCESSOR
Langues disponibles
Liste complète des langues
Langue Balise BCP 47 Script Écriture manuscrite acceptée
Afrikaans af Latn
Albanais sq Latn
Arabe ar Arab
Arménien hy Armn
Biélorusse be Cyrl
Bengali bn Beng
Bengalî bn Beng
Bulgare bg Cyrl
Catalan ca Latn
Chinois zh Hani
Croate hr Latn
Tchèque cs Latn
Danois da Latn
Néerlandais nl Latn
Anglais en Latn
Estonien et Latn
Philippin fil Latn
Finnois fi Latn
Français fr Latn
Allemand de Latn
Grec el Grek
Gujarati gu Gujr
Hébreu iw Hebr
Hindi hi Deva
Hongrois hu Latn
Islandais is Latn
Indonésien id Latn
Italien it Latn
Japonais ja Jpan
Kannara kn Knda
Khmer km Khmr
Coréen ko Kore
Laotien lo Laoo
Letton lv Latn
Lituanien lt Latn
Macédonien mk Cyrl
Malaisien ms Latn
Malayalam ml Mlym
Marathi mr Deva
Népalais ne Deva
Norvégien no Latn
Persan fa Arab
Polonais pl Latn
Portugais (Brésil et Portugal) pt Latn
Panjabi pa Guru
Roumain ro Latn
Russe ru Cyrl
Serbe sr Cyrl
Slovaque sk Latn
Slovène sl Latn
Espagnol es Latn
Suédois sv Latn
Tagalog tl Latn
Tamoul ta Taml
Télougou te Telu
Thaï th Thai
Turc tr Latn
Ukrainien uk Cyrl
Vietnamien vi Latn
Yiddish yi Hebr
Versions du processeur
ID de version Version disponible Maturité de la version Description
pretrained-ocr-v1.2-2022-11-10 Stable DG Version figée du modèle v1.0 : fichiers, configurations et binaires du modèle d'un instantané de version figés dans une image de conteneur pendant 18 mois maximum.
pretrained-ocr-v2.0-2023-06-02 Stable DG Modèle prêt pour la production, spécialisé dans les cas d'utilisation de documents. Inclut l'accès à tous les modules complémentaires OCR.
pretrained-ocr-v2.1-2024-08-07 Stable DG Les principaux axes d'amélioration de la version 2.1 sont les suivants : meilleure reconnaissance du texte imprimé, détection plus précise des cases à cocher et ordre de lecture plus précis.
pretrained-ocr-v2.1.1-2025-01-31 Version candidate Aperçu public La version 2.1.1 est semblable à la version 2.1 et est disponible dans toutes les régions, à l'exception de US, EU et asia-southeast1.

Pour en savoir plus, consultez Gérer les versions de l'outil de traitement.

Quotas et limites
Nombre maximal de pages (requêtes en ligne/synchrones) : 15
Nombre maximal de pages (requêtes par lot/hors connexion/asynchrones) : 500
Nombre maximal de pages (mode sans image, requêtes en ligne/synchrones) : 30
Uptraining
Exemple de fichier d'entrée Ouvrez-le dans une nouvelle fenêtre.