Vision API 可以使用任何 Vision 特征类型运行离线(异步)检测服务和大批量图片文件注释。例如,您可以为一批图片指定一个或多个 Vision API 特征(例如 TEXT_DETECTION、LABEL_DETECTION 和 LANDMARK_DETECTION)。
离线批量请求的输出将写入在指定 Cloud Storage 存储桶中创建的 JSON 文件中。
限制
Vision API 最多可接受 2000 个图片文件。批量图片文件数量超过该限制会返回错误。
目前支持的特征类型
| 特征类型 | |
|---|---|
CROP_HINTS |
确定图片的建议剪裁区域顶点。 |
DOCUMENT_TEXT_DETECTION |
对文档 (PDF/TIFF) 等包含密集文本的图片和包含手写内容的图片执行 OCR。TEXT_DETECTION 可用于包含稀疏文本的图片。
如果同时存在 DOCUMENT_TEXT_DETECTION 和 TEXT_DETECTION,则优先考虑。 |
FACE_DETECTION |
检测图片中的人脸。 |
IMAGE_PROPERTIES |
计算一组图片属性,例如图片的主色。 |
LABEL_DETECTION |
根据图片内容添加标签。 |
LANDMARK_DETECTION |
检测图片中的地标。 |
LOGO_DETECTION |
检测图片中的公司徽标。 |
OBJECT_LOCALIZATION |
检测并提取图片中的多个对象。 |
SAFE_SEARCH_DETECTION |
运行安全搜索可检测可能不安全的内容或不良内容。 |
TEXT_DETECTION |
对图片中的文本执行光学字符识别 (OCR)。
文本检测针对大型图片中的稀疏文本区域进行了优化。
如果图片为文档 (PDF/TIFF)、包含密集文本或包含手写内容,请改用 DOCUMENT_TEXT_DETECTION。 |
WEB_DETECTION |
检测图片中的新闻、事件或名人等主题实体,并借助强大的 Google 图片搜索在网络上查找相似的图片。 |
示例代码
使用以下代码示例对 Cloud Storage 中的一批图片文件运行离线注释服务。
Java
在试用此示例之前,请按照Vision API 快速入门:使用客户端库中的 Java 设置说明进行操作。如需了解详情,请参阅 Vision API Java 参考文档。