프로세서 목록

이 페이지에는 Document AI에서 제공하는 모든 프로세서에 관한 자세한 정보가 포함되어 있습니다. 솔루션 유형별로 모든 프로세서 목록을 볼 수 있습니다.

모든 Document AI 프로세서는 데이터 처리 및 보안 약관을 준수합니다.

자세한 내용은 프로세서 버전 관리 문서를 참고하세요. 전체 제품 할당량 및 한도 외에 특정 프로세서 한도도 적용됩니다.

텍스트 디지털화

Enterprise Document OCR (광학 문자 인식)

설명

다양한 유형의 문서에서 텍스트를 식별하고 추출합니다.

이 프로세서를 사용하면 200개가 넘는 언어로 된 문서에서 필기 텍스트를 포함한 텍스트를 식별하고 추출할 수 있습니다. 또한 프로세서는 머신러닝을 사용하여 콘텐츠의 가독성을 기반으로 문서의 품질을 평가합니다.

카테고리 디지털화
함수 OCR, 품질 분석
출시 단계 정식 버전
액세스 상태 공개
API 입력 OCR_PROCESSOR
지원되는 언어
전체 언어 목록
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
아프리칸스어 af Latn
알바니아어 sq Latn
아랍어 ar Arab
아르메니아어 hy Armn
벨라루스어 be Cyrl
벵골어 bn Beng
뱅골어 bn Beng
불가리아어 bg Cyrl
카탈로니아어 ca Latn
중국어 zh Hani
크로아티아어 hr Latn
체코 cs Latn
덴마크어 da Latn
네덜란드어 nl Latn
영어 en Latn
에스토니아어 et Latn
필리핀어 fil Latn
핀란드어 fi Latn
프랑스어 fr Latn
독일어 de Latn
그리스어 el Grek
구자라트어 gu Gujr
히브리어 iw Hebr
힌디어 hi Deva
헝가리어 hu Latn
아이슬란드어 is Latn
인도네시아어 id Latn
이탈리아어 it Latn
일본어 ja Jpan
칸나다어 kn Knda
크메르어 km Khmr
한국어 ko Kore
라오어 lo Laoo
라트비아어 lv Latn
리투아니아어 lt Latn
마케도니아어 mk Cyrl
말레이어 ms Latn
말라얄람어 ml Mlym
마라타어 mr Deva
네팔어 ne Deva
노르웨이어 no Latn
페르시아어 fa Arab
폴란드어 pl Latn
포르투갈어 (포르투갈 및 브라질) pt Latn
펀자브어 pa Guru
루마니아어 ro Latn
러시아어 ru Cyrl
세르비아어 sr Cyrl
슬로바키아어 sk Latn
슬로베니아어 sl Latn
스페인어 es Latn
스웨덴어 sv Latn
타갈로그어 tl Latn
타밀어 ta Taml
텔루구어 te Telu
태국어 th Thai
터키어 tr Latn
우크라이나어 uk Cyrl
베트남어 vi Latn
이디시어 yi Hebr
프로세서 버전
버전 ID 배포 채널 출시 버전 성숙도 설명
pretrained-ocr-v1.2-2022-11-10 정식 GA 고정된 모델 버전 1.0: 최대 18개월 동안 컨테이너 이미지에 고정된 버전 스냅샷의 모델 파일, 구성, 바이너리입니다.
pretrained-ocr-v2.0-2023-06-02 정식 GA 문서 사용 사례에 특화된 프로덕션 지원 모델입니다. 모든 OCR 부가기능에 대한 액세스가 포함됩니다.
pretrained-ocr-v2.1-2024-08-07 정식 GA v2.1의 주요 개선사항은 인쇄된 텍스트 인식 개선, 더 정확한 체크박스 감지, 더 정확한 읽기 순서입니다.
pretrained-ocr-v2.1.1-2025-01-31 출시 후보 공개 프리뷰 v2.1.1은 v2.1과 유사하며 US, EU, asia-southeast1를 제외한 모든 지역에서 사용할 수 있습니다.

자세한 내용은 프로세서 버전 관리를 참고하세요.

할당량 및 한도
최대 페이지 수 (온라인/동기 요청): 15
최대 페이지 수 (일괄/오프라인/비동기 요청): 500
최대 페이지 수 (이미지 없는 모드 온라인/동기 요청): 30
Uptraining
샘플 입력 파일 새 창에서 열기
샘플 출력 새 창에서 열기
지원되는 지역
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
추가 정보 Enterprise Document OCR

문서에서 항목을 추출합니다.

학습에 사용할 라벨이 지정된 데이터 세트와 라벨이 지정되지 않은 데이터 세트의 샘플은 샘플 데이터 세트를 참고하세요.

맞춤 추출기

설명

생성형 AI 또는 커스텀 모델을 사용하여 문서에서 필드를 추출하고, 모델을 미세 조정하여 문서에서 데이터를 정확하게 추출합니다.

카테고리 추출
함수 OCR, 항목 추출
출시 단계 정식 버전
액세스 상태 공개
API 입력 CUSTOM_EXTRACTION_PROCESSOR
참고
  • 추출에 생성형 AI를 사용하는 경우 다음을 충족해야 합니다.

    • 영어만 공식적으로 지원됩니다.
    • 제공 지역은 US, EU, northamerica-northeast1, asia-southeast1입니다.

지원되는 언어
전체 언어 목록
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
아프리칸스어 af Latn
아랍어 ar Arab
아제르바이잔어 az Latn
아제르바이잔어 (키릴 문자) az-Cyrl Cyrl
벨라루스어 be Cyrl
불가리아어 bg Cyrl
보스니아어 bs Latn
카탈로니아어 ca Latn
세부아노어 ceb Latn
체코 cs Latn
웨일즈어 cy Latn
덴마크어 da Latn
독일어 de Latn
그리스어 el Grek
영어 en Latn
에스페란토어 eo Latn
스페인어 es Latn
에스토니아어 et Latn
바스크어 eu Latn
페르시아어 fa Arab
핀란드어 fi Latn
필리핀어 fil Latn
프랑스어 fr Latn
아일랜드어 ga Latn
갈리시아어 gl Latn
힌디어 hi Deva