Authorization위치: header
multipart/form-data필수model추론에 사용할 모델을 지정하는 문자열입니다.
항상 최신 안정 모델을 가리키는 document-parse 별칭 사용을 권장합니다.
특정 모델 버전을 지정할 수도 있지만, 모델은 자주 업데이트되므로 해당 버전의 서비스가 종료되면 그 버전을 지정해 둔 애플리케이션이 영향을 받을 수 있습니다.
사용 가능한 스냅샷 모델은 기능 문서를 참고하세요.
최신 기능을 테스트하려면 document-parse-nightly를 사용하세요. 이 모델은 사전 공지 없이 업데이트될 수 있습니다.
document처리할 문서 파일입니다. 지원 파일 형식은 여기를 참고하세요.
modestring파싱 모드를 지정하는 문자열입니다. enhanced와 auto 모드는 document-parse-260128 이상 버전에서 사용할 수 있습니다.
standard를 사용하세요.enhanced를 사용하세요.auto는 페이지를 standard 또는 enhanced로 자동 분류하여 해당 모드로 처리합니다."standard"허용 값: "standard" | "enhanced" | "auto"chart_recognition차트 인식 사용 여부입니다. true이면 차트를 표로 변환합니다.
mode가 enhanced이면 이 파라미터와 관계없이 차트 인식이 항상 활성화됩니다.
true허용 값: true | falsemerge_multipage_tables여러 페이지에 걸쳐 나뉜 표를 하나로 병합할지 지정하는 불리언 값입니다. true이면 여러 페이지에 걸친 표를 하나의 연속된 표 구조로 합칩니다.
false허용 값: true | falseocrstring레이아웃 감지 전에 문서에 OCR 추론을 수행할지 지정하는 문자열입니다. auto이면 이미지 문서에만 OCR을 적용하며, PDF나 DOCX 등 이미지가 아닌 파일은 디지털 원본 문서인 경우에만 레이아웃과 텍스트를 감지합니다. force이면 입력 파일을 이미지로 변환하고 레이아웃 감지 전에 항상 OCR을 수행합니다.
"auto"허용 값: "auto" | "force"output_formatsstring각 레이아웃 요소의 출력 형식을 지정하는 문자열입니다. 가능한 값은 text, html, markdown입니다.
"['html']"coordinatesboolean각 레이아웃 요소의 바운딩 박스 좌표를 반환할지 지정하는 불리언 값입니다. 기본값은 true입니다.
true허용 값: true | falsebase64_encodingstringBase64 인코딩 문자열로 제공할 레이아웃 카테고리를 지정합니다. 모든 카테고리 이름은 레이아웃 카테고리와 HTML 태그를 참고하세요. 원본 문서 이미지에서 레이아웃 요소를 잘라내 저장하거나 활용할 때 유용합니다. 예를 들어 base64_encoding=["table"]로 설정하면 입력 문서의 모든 표 이미지를 Base64로 추출할 수 있습니다. 응답의 elements[].base64_encoding에 해당 요소 이미지의 Base64 문자열이 포함됩니다. 응답 크기가 증가할 수 있습니다.
[]wordsboolean응답에 단어 단위 OCR 결과를 포함할지 지정하는 불리언 값입니다. true이면 레이아웃 요소 외에 인식된 각 단어와 해당 바운딩 박스 좌표를 반환합니다. 응답 크기가 증가할 수 있습니다.
false허용 값: true | false