Skip to main content
POST https://api.acedata.cloud/webextrator/tasks L’API de requête de tâches WebExtrator est utilisée pour interroger les résultats des tâches render / extract historiques. Usages courants :
  • Vérification de l’enveloppe complète après la fin d’une tâche asynchrone (en plus de la notification par callback_url ou du polling actif).
  • Audit de ce qui a été soumis — les enregistrements de tâches conservent à la fois la request originale et la response finale.
  • Remplissage par lot — récupérer plusieurs entrées par id ou trace_id en une seule fois.
Les enregistrements de tâches sont conservés dans Redis pendant 7 jours. L’interface de requête de tâches est gratuite (ne compte pas dans l’utilisation des crédits).

Authentification

Il est seulement possible de consulter les tâches sous son propre compte AceDataCloud.

Paramètres de requête

Le corps de la requête est une union discriminante selon action, avec deux types d’actions :

action: "retrieve" — Requête unique

id et trace_id doivent être fournis l’un ou l’autre.

action: "retrieve_batch" — Requête par lot

ids et trace_ids doivent être fournis l’un ou l’autre.

Réponse unique

Si aucune tâche n’est trouvée, retourne { "task": null } (HTTP 200, pas 404). Les champs de temps de l’objet task sont décrits comme suit.
  • created_at, date de création de la tâche, timestamp Unix (secondes, flottant).
  • started_at, date de début d’exécution de la tâche, timestamp Unix (secondes, flottant). null si la tâche n’a pas encore commencé.
  • finished_at, date de fin de la tâche, timestamp Unix (secondes, flottant). null si la tâche n’est pas terminée.
  • elapsed, temps d’exécution de la tâche, en secondes (flottant, 3 décimales). null si la tâche n’est pas terminée.

Réponse par lot

Les ID inexistants ne génèrent pas d’erreur, ils sont simplement absents de tasks.

Exemples

Requête unique par task_id

Requête unique par trace_id

Requête par lot

Python (requests) — Polling jusqu’à la fin

Node.js (fetch) — Récupérer l’enveloppe complète après réception du callback

Réponses d’erreur

Conseils et pièges

  • Vous pouvez personnaliser trace_id. Dans la requête render/extract d’origine, téléchargez ?trace_id=… (QueryString), alignez-le avec votre propre ID d’entreprise (ID de run de workflow, etc.), puis vous pourrez rechercher des tâches avec l’ID d’entreprise. Si non transmis, le serveur génère automatiquement un UUID.
  • Durée de conservation de 7 jours. Les tâches plus anciennes renvoient task: null — si vous avez besoin d’archivage à long terme, veuillez le stocker vous-même.
  • La recherche de tâches est gratuite. Vous pouvez rechercher autant de fois que vous le souhaitez, les frais pour l’appel render/extract d’origine ont déjà été payés.
  • Privilégiez l’asynchrone + le rappel, plutôt que le polling. Si votre entreprise le permet, transmettez callback_url dans la requête d’origine, afin que la plateforme vous pousse l’enveloppe, ce qui est plus efficace que de faire un polling toutes les 2 secondes.