光學字元辨識 (OCR)
Cloud Vision API 可讓您使用光學字元辨識 (OCR) 功能,從圖片中偵測文字。也就是說,您可以使用 Cloud Vision 執行電腦視覺工作,例如圖像分析和偵測密集文件文字,包括擷取手寫內容。
Cloud Vision API 提供兩項支援光學字元辨識 (OCR) 的註解功能:
TEXT_DETECTION會偵測並從任何圖片中擷取文字。舉例來說,相片可能含有路牌或交通號誌。JSON 包含整個擷取的字串、個別字詞,以及這些字詞的周框。
DOCUMENT_TEXT_DETECTION也會從圖片中擷取文字,但回覆內容會針對密集文字和文件進行最佳化。JSON 檔案包含頁面、區塊、段落、字詞和換行資訊。
進一步瞭解
DOCUMENT_TEXT_DETECTION如何擷取手寫內容,以及從檔案 (PDF 或 TIFF) 擷取文字。