Compatibilidad de idiomas para el OCR

La función de reconocimiento de texto de la API Cloud Vision puede detectar una gran variedad de idiomas y varios idiomas en una sola imagen.

No es obligatorio proporcionar una pista de idioma al servicio, pero puedes hacerlo si el servicio tiene problemas para detectar el idioma que se usa en tu imagen.

Con el lanzamiento de la disponibilidad general del OCR de escritura a mano, las imágenes con escritura a mano ya no requieren la marca languageHints de escritura a mano cuando se usa DOCUMENT_TEXT_DETECTION.

Las sugerencias de idioma opcionales se especifican en el ImageContext de una solicitud como una lista de languageHints para una solicitud TEXT_DETECTION y DOCUMENT_TEXT_DETECTION.

Cada parámetro de código de idioma suele constar de un identificador BCP-47. Este parámetro puede tener el formato idioma-región, donde idioma hace referencia al idioma principal y región (opcional) hace referencia a una región (normalmente, el identificador de un país) de un dialecto concreto. Por ejemplo, el chino puede representarse como chino simplificado, tal como se escribe en la República Popular China (zh-Hans), o como chino tradicional, tal como se escribe en Taiwán (zh-Hant).

La función de reconocimiento de texto tiene tres niveles de compatibilidad con idiomas:

  1. Los idiomas admitidos son aquellos a los que damos prioridad y cuyo rendimiento evaluamos periódicamente.
  2. Los idiomas experimentales son aquellos que están en fase de desarrollo activo, pero que no se evalúan con regularidad.
  3. Los idiomas mapeados son aquellos que se admiten asignándolos a otro código de idioma o a un reconocedor de caracteres general. Por ejemplo, "en-GB" se admite, pero no se trata de forma diferente a "en" a la hora de reconocer texto. Hacemos todo lo posible para devolver el código de idioma asignado correcto en el campo de configuración regional de la entidad, pero es más probable que los idiomas asignados se identifiquen erróneamente como un idioma similar que los idiomas totalmente compatibles o compatibles de forma experimental.

A continuación, se muestra la lista de idiomas (con los códigos languageHint asociados) admitidos por TEXT_DETECTION y DOCUMENT_TEXT_DETECTION.

Si se deja en blanco, intentaremos detectar automáticamente el idioma más adecuado. El endpoint TEXT_DETECTION solo detectará automáticamente un subconjunto de los idiomas admitidos, mientras que el endpoint DOCUMENT_TEXT_DETECTION detectará automáticamente todos los idiomas admitidos.

Idiomas disponibles

Se priorizan y evalúan periódicamente los siguientes idiomas.

Para filtrar por funciones, escribe o selecciona directamente el idioma que quieras en el menú desplegable:

Idioma Idioma (nombre en inglés) languageHints código Secuencia de comandos Notas
Afrikaans Afrikáans af Latn
shqip Albanés sq Latn
العربية Árabe ar Arab Modern Standard
Հայ Armenio hy Armn
беларуская Bielorruso be Cyrl
বাংলা Bengalí bn Beng
български Búlgaro bg Cyrl
Català Catalán ca Latn
普通话 Chino zh Hans/Hant
Hrvatski Croata hr Latn
Čeština Checo cs Latn
Dansk Danés da Latn
Nederlands Neerlandés nl Latn
English Inglés en Latn Americano
Eesti keel Estonio et Latn
Filipino Filipino fil Latn
Suomi Finés fi Latn
Français Francés fr Latn Europea
Deutsch Alemán de Latn
Ελληνικά Griego el Grek
ગુજરાતી Gujarati gu Gujr
עברית Hebreo iw Hebr
हिन्दी Hindi hi Deva
Magyar Húngaro hu Latn
Íslenska Islandés is Latn
Bahasa Indonesia Indonesio id Latn
Italiano Italiano it Latn
日本語 Japonés ja Jpan
ಕನ್ನಡ Canarés kn Knda
ភាសាខ្មែរ Jemer km Khmr
한국어 Coreano ko Kore
ລາວ lao lo Laoo
Latviešu letón lv Latn
Lietuvių Lituano lt Latn
Македонски Macedonio mk Cyrl
Bahasa Melayu Malayo ms Latn
മലയാളം Malayalam ml Mlym
मराठी Marathi mr Deva
नेपाली Nepalí ne Deva
Norsk Noruego no Latn Bokmål
فارسی Persa fa Arab
Polski Polaco pl Latn
Português Portugués pt Latn Brasileño
ਪੰਜਾਬੀ Panyabí pa Guru Gurmuji
Română Rumano ro Latn
Русский Ruso ru Cyrl
Русский (старая орфография) Ruso ru-PETR1708 Cyrl Ortografía antigua
Српски Serbio sr Cyrl
Српски (латиница) Serbio sr-Latn Latn
Slovenčina Eslovaco sk Latn
Slovenščina Esloveno sl Latn
Español Español es Latn Europea
Svenska Sueco sv Latn
Tagalog Tagalo tl Latn
தமிழ் Tamil ta Taml
తెలుగు Telugu te Telu
ไทย Tailandés th Thai
Türkçe Turco tr Latn
Українська Ucraniano uk Cyrl
Tiếng Việt Vietnamita vi Latn
Yiddish Yiddish yi Hebr

Idiomas experimentales

Los siguientes idiomas están en fase de desarrollo activo y aún no se han evaluado de forma periódica.

Idioma Idioma (nombre en inglés) languageHints código Secuencia de comandos Notas
አማርኛ Amárico am Ethi
Αρχαία ελληνικά Griego antiguo grc Grek
অসমীয়া Asamés as Beng
Azərbaycan Azerí az Latn
Azərbaycan (qədim yazı) Azerí az-Cyrl Cyrl Ortografía antigua
Euskara Euskera eu Latn
Bosanski Bosnio bs Latn
မြန်မာ Birmano my Mymr
Cebuano Cebuano ceb Latn
ᏣᎳᎩ ᎦᏬᏂᎯᏍᏗ Cheroqui chr