Vision API 可以检测 Cloud Storage 中存储的 PDF 和 TIFF 文件中的任何 Vision API 特征。
必须使用 files:asyncBatchAnnotate 函数请求对 PDF 和 TIFF 执行特征检测;该函数将执行离线(异步)请求并通过 operations 资源提供其状态。
PDF/TIFF 请求的输出会写入在指定的 Cloud Storage 存储桶中创建的 JSON 文件。
限制
Vision API 可接受最多 2,000 页的 PDF/TIFF 文件。如果文件包含更多页面,则会返回错误。
身份验证
files:asyncBatchAnnotate 请求不支持 API 密钥。如需了解如何使用服务账号进行身份验证,请参阅使用服务账号。
用于进行身份验证的账号必须能够访问您为输出指定的 Cloud Storage 存储桶(roles/editor、roles/storage.objectCreator 或权限更高的角色)。
您可以使用 API 密钥来查询该操作的状态;如需查看相关说明,请参阅使用 API 密钥。
特征检测请求
目前,PDF/TIFF 文档检测仅适用于存储在 Cloud Storage 存储分区中的文件。响应 JSON 文件同样会保存到 Cloud Storage 存储桶。
命令行
如需执行 PDF/TIFF 文档文本检测,请发出 POST 请求并提供相应的请求正文:
curl -X POST \ -H "Authorization: Bearer $(gcloud auth application-default print-access-token)" \ -H "Content-Type: application/json; charset=utf-8" \ https://vision.googleapis.com/v1/files:asyncBatchAnnotate -d "{ 'requests':[ { 'inputConfig': {