Liste des fonctionnalités

L'API Cloud Vision vous permet actuellement d'utiliser les fonctionnalités suivantes :

Tous les types de fonctionnalités

Détection de texte

Image d'un panneau de signalisation
  • Reconnaissance optique des caractères (OCR) dans une image, détection de texte et conversion du texte en code machine. Identifie et extrait le texte UTF-8 dans une image.
  • Images : optimisée pour les zones de texte épars dans une image plus grande.
  • Réponse : affiche la liste de mots identifiés avec le texte, des cadres de délimitation et des textAnnotations, ainsi que la hiérarchie structurelle du texte détecté par l'OCR (fullTextAnnotation).
    • Hiérarchie de la structure du texte extrait :
      • TextAnnotation -> Page -> Block -> Paragraph -> Word -> Symbol.
      • Chaque composant structurel à partir de la page peut avoir ses propres propriétés, telles que les langues détectées, les sauts, etc.
  • Langues acceptées : fonctionne avec les langues acceptées, mappées et expérimentales.
  • Valeur d'énumération de la fonctionnalité : TEXT_DETECTION.

Détection de documents texte (texte dense/écriture manuscrite)

Image dense avec des annotations
Image avec du texte manuscrit
  • Reconnaissance optique de caractères (OCR) dans un fichier (PDF/TIFF) ou une image de texte dense ; reconnaissance de texte dense et conversion du texte en code machine.
  • Fichiers : optimisé pour les fichiers de document (PDF/TIFF).
  • Images : optimisée pour les zones de texte dense dans une image (images correspondant à des documents) et les images contenant du texte manuscrit.
  • Réponse : affiche la hiérarchie structurelle du texte détecté avec l'OCR (fullTextAnnotation).
    • Hiérarchie de la structure du texte extrait :
      • TextAnnotation -> Page -> Block -> Paragraph -> Word -> Symbol.
      • Chaque composant structurel à partir de la page peut avoir ses propres propriétés, telles que les langues détectées, les sauts, etc.
  • Langues acceptées : fonctionne avec les langues acceptées, mappées et expérimentales.
  • Valeur d'énumération de la fonctionnalité : DOCUMENT_TEXT_DETECTION.
    • Prioritaire lorsque DOCUMENT_TEXT_DETECTION et TEXT_DETECTION sont demandés.

Détection de points de repère1

Image de la cathédrale Saint-Basile-le-Bienheureux
  • Affiche le nom du point de repère, un score de confiance et un cadre de délimitation du point de repère sur l'image.
  • Indique les coordonnées de l'entité détectée.

Détection de logos2

Logo annoté
  • Affiche une description textuelle de l'entité identifiée, un score de confiance et un polygone de délimitation du logo sur le fichier.

Détection de thèmes3

Image d'une rue de Shanghai
  • Fournit des thèmes généralisés pour une image.
  • Pour chaque thème, vous obtenez une description textuelle, un score de confiance et une note de pertinence du thème.

Propriétés des images4

Image de Bali avec des propriétés