Skip to main content
AI Scraper Studio API 是一组端点,允许你使用 AI 创建 Scraper Studio 爬虫并使用自我修复工具更新现有爬虫,无需使用 UI。本页说明了应该调用哪个端点以及调用顺序。 两个流程都是异步的:你启动一个 AI 任务,然后检查其进度直到完成。

工作流 1:使用 AI 创建新爬虫

当你想让 AI 从头为目标网站生成爬虫(schema + 代码)时,请使用这些端点。
  1. 创建爬虫实体
    → 创建爬虫模板
  2. 启动 AI 生成任务(schema + 代码)
    → 触发 AI Flow 以创建代码
  3. 轮询直到 AI 任务完成并返回结果
    → AI 任务进度

工作流 2:使用自我修复更新现有爬虫

当你已经有一个爬虫并想使用提示修复或修改它时,请使用这些端点。
  1. 启动自我修复重构任务
    → 触发自我修复
  2. 轮询直到重构任务完成或暂停等待用户输入
    → 自我修复任务进度
  3. 如果进度返回 status: "pending_answer",批准或拒绝建议的差异
    → 恢复自我修复任务
  4. 爬虫准备好后,启动采集
    → 启动采集
创建或更新后,使用标准 Scraper Studio API 启动端点运行它(手动触发、计划、队列等)。

工作流 3:使用自动自我修复自动修复爬虫

当你希望 Scraper Studio 在爬虫成功率低于你设置的阈值时自动启动修复作业,请使用此端点。
  1. 启用自动自我修复并设置触发规则
    → 启用自动自我修复
每条触发规则的作用,请参见 Scraper Studio 自动自我修复。
不确定使用哪个?
初次使用 API?参见:API 入门指南