GET
/batch/extract/{id}
获取批量提取任务状态

检查批量提取任务的状态并获取提取的数据。

响应状态:

  • processing:正在提取中
  • completed:所有提取已完成
  • failed:任务失败(查看错误详情)

结果格式: 结果数组中的每个 URL 包含:

  • 匹配 Schema 的提取数据
  • 成功/失败状态
  • 适用时的单独错误消息
  • 提取质量的置信度分数

授权

YOUR_API_KEY
授权Bearer <token>

在 Thunderbit Dashboard 获取 API key。请求头格式:Authorization: Bearer YOUR_API_KEY

位置: header

路径参数

id*string必填

批量任务 ID

查询参数

pageinteger默认值:0

Page number (0-based), default 0

取值范围:0 <= x
pageSizeinteger默认值:20

Number of results per page (1-100), default 20

取值范围:1 <= x <= 100

响应

application/json

Success response

successboolean
dataobject
展开子属性
idstring
statusstring
取值范围"PENDING" | "PROCESSING" | "COMPLETED" | "FAILED" | "CANCELLED" | "UNKNOWN"
totalinteger
completedinteger
creditsUsedinteger
resultsobject[]
展开子属性
urlstring
successboolean
dataobject[]

Extracted structured data for this URL (present when success is true)

errorobject
展开子属性
codestring
示例:EXTRACT_FAILED
messagestring
createdAtstring

Timestamp when the job was created

completedAtstring

Timestamp when the job completed (null if still processing)

分页

  • pageSize 默认 20,单次请求上限 100。需要一次拿到最多结果时设为 pageSize=100
  • 当总量超过 100 时,递增 page(从 0 开始)直到 results 为空:page=0page=1、依此类推。
  • 响应里的 total 表示该批次的结果总数。

目录