요청 생성
최대 2,000페이지의 지원 형식 문서에 대한 추론 요청을 제출합니다. API는 요청을 받으면 즉시 요청 ID를 반환합니다. 입력 파일은 10페이지씩 배치로 분할되며 각 배치에서 추론이 수행됩니다.
결과 조회
요청 ID로 추론 결과를 조회하고 각 배치의 상태를 실시간으로 확인합니다.
파싱 결과를 가져오는 방법:
- 최상위
status가completed가 될 때까지 이 엔드포인트를 폴링하거나 각batches[].status를 개별적으로 추적합니다. - 완료된 각 배치의 결과를
batches[].download_url에서 다운로드합니다. - 다운로드한 각 결과는 동기 Document Parse 응답과 같은 형식의 JSON 객체입니다.
elements,content(html/markdown/text),coordinates,usage등을 포함하며, 해당 배치의start_page부터end_page까지의 페이지를 담습니다. - 배치를
id순서대로 이어 붙여 전체 문서를 재구성합니다.
각 download_url은 15분간 유효한 pre-signed URL입니다. 새 URL을 받으려면 이 엔드포인트를 다시 호출하세요. 결과는 요청 시점부터 30일간 제공됩니다.
요청 목록 조회
모든 문서 파싱 비동기 요청의 목록과 상태, 타임스탬프를 조회합니다.
추론 결과 삭제
요청의 추론 결과를 영구적으로 삭제합니다. 이전에 발급된 download_url도 더 이상 동작하지 않습니다.
완료된 요청만 삭제할 수 있습니다. 아직 처리 중인 요청은 request_in_progress로 거부되므로 완료된 뒤에 다시 시도하세요.
이미 삭제된 요청을 다시 삭제해도 성공하므로 안전하게 재시도할 수 있습니다.
단건 삭제
여러 건 삭제
한 번에 최대 100개의 request ID를 보낼 수 있습니다. 중복된 ID는 하나로 합쳐지므로 results 배열이 보낸 목록보다 짧을 수 있습니다.
삭제는 되돌릴 수 없습니다. 필요한 결과는 삭제 전에 내려받으세요.
벌크 엔드포인트는 호출 자체가 유효하면 모든 request ID가 실패해도 200을 반환합니다. HTTP 상태 코드만 보지 말고 results[].deleted를 확인하세요. 100개를 초과하거나 빈 목록을 보내는 등 호출 자체의 문제는 4xx로 반환됩니다.
오류 처리
Document Parse 비동기 API에서는 다음 세 가지 상황에서 오류가 발생할 수 있습니다.