處理要求的回應中會包含 Document 物件,其中包含已處理文件的所有資訊,包括 Document AI 擷取的所有結構化資訊。
本頁提供文件範例,並將 OCR 結果的各個層面與 Document 物件 JSON 的特定元素建立對應關係,藉以說明 Document 物件的版面配置。還提供用戶端程式庫、程式碼範例和 Document AI Toolbox SDK 程式碼範例。這些程式碼範例使用線上處理,但 Document 物件剖析的運作方式與批次處理相同。

橘色和藍色矩形和箭頭分別代表所連線物件的至少一個欄位為 .layout 或 detectedLanguage。圖表使用烏鴉腳標記法。
使用專門設計的 JSON 檢視器或編輯公用程式,展開或收合元素。在純文字公用程式中查看原始 JSON 效率不彰。
文字、版面配置和品質分數
以下是文字文件範例:

以下是 Enterprise Document OCR 處理器傳回的完整文件物件:
由於處理器會執行 OCR,因此這項 OCR 輸出內容一律會納入 Document AI 處理器輸出內容。這項功能會使用現有的 OCR 資料,因此您可以透過內嵌文件選項,將這類 JSON 資料輸入 Document AI 處理器。
image=None, # all our samples pass this var
mime_type="application/json",
inline_document=document_response # pass OCR output to CDE input - undocumented
以下列舉幾個重要欄位:
原始文字
text 欄位包含 Document AI 辨識的文字。除了空格、定位點和換行符之外,這段文字不含任何版面配置結構。這是唯一儲存文件文字資訊的欄位,也是文件文字的單一可靠資料來源。其他欄位可依位置參照文字欄位的部分 (startIndex 和 endIndex)。
{
text: "Sample Document\nHeading 1\nLorem ipsum dolor sit amet, ..."
}
頁面大小和語言
文件物件中的每個 page 都對應到範例文件中的實體頁面。由於是單一 PNG 圖片,因此 JSON 輸出範例只包含一頁。