Skip to main content
POST https://api.acedata.cloud/webextrator/tasks WebExtrator 작업 조회 API는 과거의 render / extract 작업 결과를 조회하는 데 사용됩니다. 일반적인 용도:
  • 비동기 작업 완료 후 재조회 전체 envelope( callback_url 푸시 또는 수동 폴링 제외).
  • 감사 자신이 제출한 내용 확인 — 작업 기록은 원본 request와 최종 response를 동시에 저장합니다.
  • 배치 회수 — 한 번에 id 또는 trace_id로 여러 항목을 가져옵니다.
작업 기록은 Redis에 7일 동안 보관됩니다. 작업 조회 인터페이스는 무료입니다(크레딧 사용량에 포함되지 않음).

인증

자신의 AceDataCloud 계정 하의 작업만 조회할 수 있습니다.

요청 매개변수

요청 본문은 action에 따라 구분되는 판별식 조합으로, 두 가지 동작이 있습니다:

action: "retrieve" — 단일 조회

idtrace_id 중 하나를 선택하여 전달합니다.

action: "retrieve_batch" — 배치 조회

idstrace_ids 중 하나를 선택하여 전달합니다.

단일 응답

조회할 수 없을 경우 { "task": null }을 반환합니다(HTTP 200, 404가 아님). task 객체의 타이밍 필드는 다음과 같습니다.
  • created_at, 작업 생성 시간, Unix 타임스탬프(초, 부동 소수점).
  • started_at, 작업 시작 실행 시간, Unix 타임스탬프(초, 부동 소수점). 작업이 시작되지 않았을 경우 null입니다.
  • finished_at, 작업 완료 시간, Unix 타임스탬프(초, 부동 소수점). 작업이 완료되지 않았을 경우 null입니다.
  • elapsed, 작업 실행 소요 시간, 단위는 초(부동 소수점, 소수점 3자리). 작업이 완료되지 않았을 경우 null입니다.

배치 응답

존재하지 않는 ID는 오류를 발생시키지 않으며, 단지 tasks에서 누락됩니다.

예시

task_id로 단일 조회

trace_id로 단일 조회

배치 조회

Python (requests) — 완료될 때까지 폴링

Node.js (fetch) — 콜백 수신 후 전체 envelope 가져오기

오류 응답

팁 및 주의사항

  • trace_id를 자주 정의할 수 있습니다. 원래의 render/extract 요청에 업로드할 때 ?trace_id=…(QueryString)을 사용하여 자신의 비즈니스 ID(작업 흐름 run id 등)와 일치시킵니다. 이후에는 비즈니스 ID로 작업을 조회할 수 있습니다. 전달하지 않으면 서버가 자동으로 UUID를 생성합니다.
  • 보존 기간 7일. 더 이전의 작업은 task: null을 반환합니다 —— 장기 보관이 필요하면 직접 데이터베이스에 저장하세요.
  • 작업 조회는 무료입니다. 원하는 만큼 조회할 수 있으며, 원래의 render/extract 호출 시 비용은 이미 지불되었습니다.
  • 비동기 + 콜백을 우선 사용하고, 폴링은 피하세요. 비즈니스가 허용된다면, 원 요청에 callback_url을 전달하여 플랫폼이 envelope을 당신에게 푸시하도록 하세요. 2초마다 폴링하는 것보다 더 효율적입니다.