Skip to main content
在 Claude Code、Cursor 或 Codex 中直接获取 Bright Data Scraper API 的结构化数据。把下面这段粘贴进去:

Read https://docs.brightdata.com/llms.txt, then use the Bright Data Scraper API to scrape https://www.amazon.com/dp/B0FQFB8FMG and show me the title, price and rating.

智能体会读取文档索引,安装所需内容并返回记录。若要自己运行同样的流程,或查看它安装了什么,请从下面开始。

获取第一个 Scraper API 结果

两条命令即可从 Bright Data Scraper API 获得结构化 JSON。结果与面向开发者的快速开始相同,只是在终端中完成。
1

安装并进行身份验证

bdata login 会打开浏览器进行授权,因此您无需粘贴密钥。在 SSH 或任何无图形界面的环境中,请使用 bdata login --device如果您的机器禁止全局安装,请改用 npx 运行每条命令:
请保留 -p @brightdata/cli 部分。npx 不会把 bdata 放入 PATH,因此每条命令都需要该前缀;而简写的 npx bdata 会解析到 npm 上另一个无关的包,而非 Bright Data CLI。
2

抓取一个页面

您应当看到打印出的商品 JSON。这需要 10 到 30 秒。
完整记录包含 67 个字段。运行 bdata pipelines list 可查看所有可用的 pipeline 类型。
安装智能体技能后,智能体会自行调用这些命令:
然后用自然语言提问,而不必输入 CLI 命令:
Prompt

如何抓取其他网站

更换 pipeline 类型即可。CLI 以每个 pipeline 采集的内容命名,因此不需要查找 dataset_id
查看当前完整集合:
搜索引擎不属于 pipeline。Google、Bing 和 Yandex 结果请使用 bdata search,没有预构建抓取器的页面请使用 bdata scrape 安装技能后,您无需自己选择类型。只需说明想要的数据,智能体会把网站匹配到对应的 pipeline:
Prompt

智能体会配置些什么

它们不是互相替代的方案。参见如何搭配使用

前提条件

  • 一个 Bright Data 账户。新账户每月获得 5,000 个免费信用额度,无需信用卡
  • 一个具备终端访问能力的编码智能体:Claude Code、Cursor、Codex,或技能生态支持的 40+ 个智能体中的任意一个

如何让智能体读到全部文档

把智能体指向 llms.txt,这是按照 llms.txt 标准组织的 Bright Data 全部文档页面索引。每个条目都链接到页面的 .md 版本,因此智能体读到的是干净的 markdown,无需解析 HTML。
Prompt
若不想每次提示都写一遍,可以把索引保存到项目中,让每个会话都能读到:
共发布两个文件。llms.txt 是索引,适合作为实时智能体会话的默认选择。llms-full.txt 是全部文档合并成的单个文件,面向 RAG 管道和长上下文注入,而非交互式使用。
面向智能体的高效用法:先加载 llms.txt 了解有哪些内容,找到相关页面,再获取该页面的 .md URL 查看细节。在任意文档 URL 后追加 .md 即可得到 markdown,例如 /cn/products/mcp-server/overview.md
希望智能体实时查询文档而不是加载文件?Docs MCP 将本文档以可搜索的 MCP 资源形式暴露,智能体可在自身推理循环中检索页面。它与下文的 Bright Data MCP 是两个不同的服务:Docs MCP 读取文档,Bright Data MCP 访问实时网络。 在搭建检索管道而非实时智能体会话?请使用 llms-full.txt,即以单个 markdown 文件形式提供的完整文档:
llms-full.txt 体积很大。对于实时智能体会话,请先加载 llms.txt,再按需获取单个 .md 页面,这样消耗的 token 少得多。

如何安装 Bright Data 技能

技能是定义在 SKILL.md 文件中的可复用指令集,为智能体内置 Bright Data API 知识以及通过 Bright Data CLI 执行操作的命令。一条命令即可安装,并自动检测您已安装的智能体:
技能直接调用 bdata,因此第一步中的全局安装是它们能够工作的前提。如果 bdata 不在 PATH 中,技能的 command -v bdata 检查会失败。 确认安装成功:
每个已安装的技能都会单独占一行,显示其路径以及被链接到的智能体:
列表为空说明安装未生效。请重新运行 npx skills add brightdata/skills 并回答作用域提示。 该技能包涵盖搜索、抓取、结构化提取、SDK、代理、Scraper Studio 与 MCP 编排。您最先会用到的是: 运行 npx skills add brightdata/skills --list 查看当前完整集合。 安装完成后,智能体会直接调用它们:

安装到指定的智能体

技能会安装到项目中的 .claude/skills/,加上 -g 则安装到 ~/.claude/skills/。Claude Code 会在下一个会话中发现它们。可用 npx skills list -a claude-code 验证。
在任意命令后加上 -g 即可跨项目全局安装。

管理已安装的技能

技能属于开放智能体技能生态,可在 40+ 个编码智能体中使用。源代码,包括每个 SKILL.md 及其可运行脚本,位于 github.com/brightdata/skills。新技能会持续加入,欢迎 star 该仓库以便关注。

如何连接 Bright Data MCP Server

Bright Data MCP Server 通过 60+ 个用于搜索、抓取、结构化提取和浏览器自动化的工具,为智能体提供实时网页访问能力。它运行在 Web Unlocker API 上,因此每个请求都会处理代理轮换、反机器人挑战和验证码求解。 下面的每段配置都会把 API 密钥写入智能体的配置文件。这类文件常被提交到版本控制中,因此请像对待其他机密一样对待该密钥。若想完全避免在文件中留存长期密钥,该服务器也支持 OAuth 2.1,由用户在浏览器中登录。
然后用类似 Extract the Bright Data overview section from LinkedIn 的提示词试一下。
控制 token 用量。 使用工具分组只加载需要的工具,例如 groups=ecommerce,social,或直接指定单个工具,例如 tools=web_data_amazon_product。工具列表越小,上下文越小,可用请求越多。
它有两个版本。远程服务器完全托管,无需任何配置。本地服务器可自托管,适用于本地部署或私有云。两者的说明参见 MCP Server 概览,其他客户端参见集成指南

技能 MCP 还是两者都用

技能加 CLI 是默认组合。技能承载知识:哪个 Bright Data 产品适合当前任务、如何进行身份验证、如何处理分页和错误。CLI 负责执行。在智能体真正运行命令之前,两者都不会产生实时请求。 当智能体没有终端时,MCP Server 才是关键。它把同样的能力以工具形式暴露在智能体自身的循环中,这是托管助手或无法调用 shell 的客户端唯一可行的路径。 本页把终端访问列为前提条件,因此这里的 MCP 是可选项。当您希望在工具循环中而不是通过 shell 获得实时网页访问时,再加上它。

常见问题

不需要。npx skills add brightdata/skillsnpx -y @brightdata/mcp 都是按需获取的,因此没有需要维护的全局依赖。Bright Data CLI 也可以通过 npx 运行:npx -p @brightdata/cli brightdata --version
是的。MCP Server 运行在 Web Unlocker API 上,因此从账户级免费套餐的每月 5,000 个信用额度中扣除,且来自同一个共享额度池。在团队账户中,该额度池由账户内所有用户共享。
不需要。远程和本地 MCP Server 都只使用 API 密钥进行身份验证。形如 brd-customer-{customer_id}-zone-{zone_name} 的用户名用于原生代理访问,与 MCP 无关。如果第三方工具要求填写用户名,请留空。
技能可在开放智能体技能生态的 40+ 个智能体中使用,包括 Claude Code、Cursor 和 Codex。MCP Server 适用于任何兼容 MCP 的客户端。llms.txt 适用于任何能够获取 URL 的工具。
可以。给它一个目标 URL 和一句描述所需字段的说明,Bright Data CLI 就会通过 Scraper Studio 生成抓取器。完整的构建、运行与自我修复循环的可复制提示词参见 Scraper Studio 编码智能体提示词

后续步骤

选择产品

将目标网站匹配到合适的 Bright Data 产品,然后直接开始第一个请求。

用提示词构建抓取器

可复制的 Claude Code、Cursor 和 Codex 提示词,用于构建、运行并自我修复抓取器。

Bright Data CLI

在终端中进行抓取、搜索、管理 zone 并控制远程浏览器。