工作原理
你向 Bright Data ChatGPT Scraper API 发送一个提示词。Bright Data 负责处理抓取基础设施,并返回干净、结构化的 JSON,其中包含答案、引用来源和来源信息。dataset_id,并以 JSON、NDJSON 或 CSV 格式返回结果。
响应内容示例
Bright Data ChatGPT Scraper API 于 2026 年 9 月 6 日返回的单条记录(已裁剪为所示字段)。可在快速开始中亲自发送该请求。支持哪些功能
带引用来源的搜索
从 ChatGPT 网页搜索中获取结构化答案,附带来源引用、位置和关联的参考链接。
追问提示词
发送额外的提示词,在同一搜索上下文中获取追问的答案。
购物和地图结果
检测 ChatGPT 何时针对地点类查询返回购物商品卡片或基于地图的结果。
网页搜索控制
使用
web_search 来允许或禁用实时网页搜索,并使用 web_search_triggered 来判断搜索是否实际运行过。请求方式
Bright Data Scraper API 支持两种请求方式,请根据您的数据量和延迟需求选择。
详见了解同步与异步请求。
两个端点都接受两种请求体格式:本页所有示例使用的纯 JSON 数组,或带有
input 数组的对象。当您同时传入 custom_output_fields 或 limit_per_input(两个端点均支持),或在 /trigger 上传入 deliver 配置时,请使用对象格式。详见请求体。
功能与限制
还有哪些 AI 答案引擎有爬虫
爬虫库还覆盖另外五个引擎。每个都接受提示词并返回带引用的回答;链接可在控制面板中打开对应爬虫,国家列表说明该引擎可定位的国家。
ChatGPT 自身的国家列表见 GitHub。网络搜索控制因引擎而异:ChatGPT 和 Grok 接受
web_search 输入,Gemini 自行决定。详见查询扩展与网络搜索控制。
常见问题
数据是实时抓取的吗?
是的。每次请求都会触发一个实时的 ChatGPT 搜索会话。不存在缓存或过时的数据。处理时间取决于提示词的复杂程度、是否启用网页搜索以及爬虫负载。Bright Data ChatGPT Scraper API 不公布固定的响应时间。同步请求最多等待 1 分钟,之后返回 HTTP202 和 snapshot_id,并继续以异步方式采集。
响应时间为什么会发生变化?
OpenAI 会调整其页面的提供方式,Bright Data ChatGPT Scraper API 的采集器也会相应更新。即使成功率保持不变,采集器更新也可能改变一次采集所需的时间。对于生产环境的工作负载,请基于异步工作流或 Webhook 投递进行构建,这样较长的运行时间不会破坏集成。我能在多次请求之间保持对话上下文吗?
不能。每次请求都会开启一个全新的 ChatGPT 会话。请求之间不会保留任何记忆或上下文。若要在单次请求内提出追问,请使用additional_prompt 字段。
与使用代理或 Web Unlocker API 抓取有何不同?
使用代理或 Web Unlocker API 抓取时,您仍需编写和维护自己的解析逻辑,并在目标网站页面结构变化时随时更新。Bright Data Scraper API 处理整个链路:代理轮换、反爬绕过与解析。您只需发送 URL 或关键词,即可获得干净的结构化 JSON,无需自建抓取基础设施或维护解析器。后续步骤
快速开始
在 5 分钟内用你的第一个提示词搜索 ChatGPT。
端点
每个端点一个请求,附实际抓取的响应。
API 参考
端点规格、参数和响应架构。