이 페이지에는 Document AI에서 제공하는 모든 프로세서에 관한 자세한 정보가 포함되어 있습니다. 솔루션 유형별로 모든 프로세서 목록을 볼 수 있습니다.
모든 Document AI 프로세서는 데이터 처리 및 보안 약관을 준수합니다.
자세한 내용은 프로세서 버전 관리 문서를 참고하세요. 전체 제품 할당량 및 한도 외에 특정 프로세서 한도도 적용됩니다.
텍스트 디지털화
Enterprise Document OCR (광학 문자 인식)
| 설명 |
다양한 유형의 문서에서 텍스트를 식별하고 추출합니다.
이 프로세서를 사용하면 200개가 넘는 언어로 된 문서에서 필기 텍스트를 포함한 텍스트를 식별하고 추출할 수 있습니다. 또한 프로세서는 머신러닝을 사용하여 콘텐츠의 가독성을 기반으로 문서의 품질을 평가합니다.
|
| 카테고리 |
디지털화 |
| 함수 |
OCR, 품질 분석 |
| 출시 단계 |
정식 버전 |
| 액세스 상태 |
공개
lock_open
|
| API 입력 |
OCR_PROCESSOR |
| 지원되는 언어 |
전체 언어 목록
| 언어 이름 |
BCP 47 태그 |
스크립트 |
필기 입력 지원 |
| 아프리칸스어 |
af |
Latn |
|
| 알바니아어 |
sq |
Latn |
|
| 아랍어 |
ar |
Arab |
|
| 아르메니아어 |
hy |
Armn |
|
| 벨라루스어 |
be |
Cyrl |
|
| 벵골어 |
bn |
Beng |
|
| 뱅골어 |
bn |
Beng |
|
| 불가리아어 |
bg |
Cyrl |
|
| 카탈로니아어 |
ca |
Latn |
|
| 중국어 |
zh |
Hani |
|
| 크로아티아어 |
hr |
Latn |
|
| 체코 |
cs |
Latn |
|
| 덴마크어 |
da |
Latn |
|
| 네덜란드어 |
nl |
Latn |
|
| 영어 |
en |
Latn |
|
| 에스토니아어 |
et |
Latn |
|
| 필리핀어 |
fil |
Latn |
|
| 핀란드어 |
fi |
Latn |
|
| 프랑스어 |
fr |
Latn |
|
| 독일어 |
de |
Latn |
|
| 그리스어 |
el |
Grek |
|
| 구자라트어 |
gu |
Gujr |
|
| 히브리어 |
iw |
Hebr |
|
| 힌디어 |
hi |
Deva |
|
| 헝가리어 |
hu |
Latn |
|
| 아이슬란드어 |
is |
Latn |
|
| 인도네시아어 |
id |
Latn |
|
| 이탈리아어 |
it |
Latn |
|
| 일본어 |
ja |
Jpan |
|
| 칸나다어 |
kn |
Knda |
|
| 크메르어 |
km |
Khmr |
|
| 한국어 |
ko |
Kore |
|
| 라오어 |
lo |
Laoo |
|
| 라트비아어 |
lv |
Latn |
|
| 리투아니아어 |
lt |
Latn |
|
| 마케도니아어 |
mk |
Cyrl |
|
| 말레이어 |
ms |
Latn |
|
| 말라얄람어 |
ml |
Mlym |
|
| 마라타어 |
mr |
Deva |
|
| 네팔어 |
ne |
Deva |
|
| 노르웨이어 |
no |
Latn |
|
| 페르시아어 |
fa |
Arab |
|
| 폴란드어 |
pl |
Latn |
|
| 포르투갈어 (포르투갈 및 브라질) |
pt |
Latn |
|
| 펀자브어 |
pa |
Guru |
|
| 루마니아어 |
ro |
Latn |
|
| 러시아어 |
ru |
Cyrl |
|
| 세르비아어 |
sr |
Cyrl |
|
| 슬로바키아어 |
sk |
Latn |
|
| 슬로베니아어 |
sl |
Latn |
|
| 스페인어 |
es |
Latn |
|
| 스웨덴어 |
sv |
Latn |
|
| 타갈로그어 |
tl |
Latn |
|
| 타밀어 |
ta |
Taml |
|
| 텔루구어 |
te |
Telu |
|
| 태국어 |
th |
Thai |
|
| 터키어 |
tr |
Latn |
|
| 우크라이나어 |
uk |
Cyrl |
|
| 베트남어 |
vi |
Latn |
|
| 이디시어 |
yi |
Hebr |
|
|
| 프로세서 버전 |
| 버전 ID |
배포 채널 |
출시 버전 성숙도 |
설명 |
pretrained-ocr-v1.2-2022-11-10 |
정식 |
GA
|
고정된 모델 버전 1.0: 최대 18개월 동안 컨테이너 이미지에 고정된 버전 스냅샷의 모델 파일, 구성, 바이너리입니다.
|
pretrained-ocr-v2.0-2023-06-02 |
정식 |
GA
|
문서 사용 사례에 특화된 프로덕션 지원 모델입니다. 모든 OCR 부가기능에 대한 액세스가 포함됩니다.
|
pretrained-ocr-v2.1-2024-08-07 |
정식 |
GA
|
v2.1의 주요 개선사항은 인쇄된 텍스트 인식 개선, 더 정확한 체크박스 감지, 더 정확한 읽기 순서입니다.
|
pretrained-ocr-v2.1.1-2025-01-31 |
출시 후보 |
공개 프리뷰
|
v2.1.1은 v2.1과 유사하며 US, EU, asia-southeast1를 제외한 모든 지역에서 사용할 수 있습니다.
|
자세한 내용은 프로세서 버전 관리를 참고하세요.
|
| 할당량 및 한도 |
| 최대 페이지 수 (온라인/동기 요청): |
15 |
| 최대 페이지 수 (일괄/오프라인/비동기 요청): |
500 |
| 최대 페이지 수 (이미지 없는 모드 온라인/동기 요청): |
30 |
|
| Uptraining |
|
| 샘플 입력 파일 |
새 창에서 열기
|
| 샘플 출력 |
새 창에서 열기
|
| 지원되는 지역 |
asia-south1
asia-southeast1
australia-southeast1
eu
europe-west2
europe-west3
northamerica-northeast1
us
|
| 추가 정보 |
Enterprise Document OCR
|
학습에 사용할 라벨이 지정된 데이터 세트와 라벨이 지정되지 않은 데이터 세트의 샘플은 샘플 데이터 세트를 참고하세요.
맞춤 추출기
| 설명 |
생성형 AI 또는 커스텀 모델을 사용하여 문서에서 필드를 추출하고, 모델을 미세 조정하여 문서에서 데이터를 정확하게 추출합니다.
|
| 카테고리 |
추출 |
| 함수 |
OCR, 항목 추출 |
| 출시 단계 |
정식 버전 |
| 액세스 상태 |
공개
lock_open
|
| API 입력 |
CUSTOM_EXTRACTION_PROCESSOR |
| 참고 |
|
| 지원되는 언어 |
전체 언어 목록
| 언어 이름 |
BCP 47 태그 |
스크립트 |
필기 입력 지원 |
| 아프리칸스어 |
af |
Latn |
|
| 아랍어 |
ar |
Arab |
|
| 아제르바이잔어 |
az |
Latn |
|
| 아제르바이잔어 (키릴 문자) |
az-Cyrl |
Cyrl |
|
| 벨라루스어 |
be |
Cyrl |
|
| 불가리아어 |
bg |
Cyrl |
|
| 보스니아어 |
bs |
Latn |
|
| 카탈로니아어 |
ca |
Latn |
|
| 세부아노어 |
ceb |
Latn |
|
| 체코 |
cs |
Latn |
|
| 웨일즈어 |
cy |
Latn |
|
| 덴마크어 |
da |
Latn |
|
| 독일어 |
de |
Latn |
|
| 그리스어 |
el |
Grek |
|
| 영어 |
en |
Latn |
|
| 에스페란토어 |
eo |
Latn |
|
| 스페인어 |
es |
Latn |
|
| 에스토니아어 |
et |
Latn |
|
| 바스크어 |
eu |
Latn |
|
| 페르시아어 |
fa |
Arab |
|
| 핀란드어 |
fi |
Latn |
|
| 필리핀어 |
fil |
Latn |
|
| 프랑스어 |
fr |
Latn |
|
| 아일랜드어 |
ga |
Latn |
|
| 갈리시아어 |
gl |
Latn |
|
| 힌디어 |
hi |
Deva |
| |