跳转到主要内容
POST https://api.acedata.cloud/webextrator/tasks WebExtrator 任务查询 API 用于查询历史的 render / extract 任务结果。常见 用法:
  • 异步任务完成后回查完整 envelope(除了 callback_url 推送或主动轮询)。
  • 审计自己提交过什么 —— 任务记录同时存了原始 request 与最终 response
  • 批量回填 —— 一次按 idtrace_id 拉多条。
任务记录在 Redis 中保留 7 天 任务查询接口免费(不计入 Credits 用量)。

鉴权

只能查到自己 AceDataCloud 账户下的任务。

请求参数

请求体是按 action 区分的判别式联合,共两种动作:

action: "retrieve" —— 单条查询

idtrace_id 二选一传入。

action: "retrieve_batch" —— 批量查询

idstrace_ids 二选一传入。

单条响应

查不到时返回 { "task": null }(HTTP 200,不是 404)。

批量响应

不存在的 ID 不会报错,只是从 tasks 中缺失。

示例

按 task_id 查询单条

按 trace_id 查询单条

批量查询

Python (requests) —— 轮询直到完成

Node.js (fetch) —— 收到回调后再拉完整 envelope

错误响应

提示与坑

  • 能自定义 trace_id 就自定义。 在原始 render/extract 请求上传 ?trace_id=…(QueryString),把它跟你自己的业务 ID(工作流 run id 等)对齐, 之后就能用业务 ID 查任务。没传时服务器自动生成 UUID。
  • 保留期 7 天。 更早的任务返回 task: null —— 需要长期归档请自行落库。
  • 任务查询免费。 想查多少次就查多少次,原始 render/extract 调用时费用已经付过。
  • 优先用异步 + 回调,而不是轮询。 业务允许的话,在原请求里传 callback_url,让平台把 envelope 推送给你,比每 2 秒轮一次更高效。