Read https://docs.brightdata.com/llms.txt, then use the Bright Data Scraper API to scrape https://www.amazon.com/dp/B0FQFB8FMG and show me the title, price and rating.
获取第一个 Scraper API 结果
两条命令即可从 Bright Data Scraper API 获得结构化 JSON。结果与面向开发者的快速开始相同,只是在终端中完成。1
安装并进行身份验证
bdata login 会打开浏览器进行授权,因此您无需粘贴密钥。在 SSH 或任何无图形界面的环境中,请使用 bdata login --device。如果您的机器禁止全局安装,请改用 npx 运行每条命令:-p @brightdata/cli 部分。npx 不会把 bdata 放入 PATH,因此每条命令都需要该前缀;而简写的 npx bdata 会解析到 npm 上另一个无关的包,而非 Bright Data CLI。2
抓取一个页面
bdata pipelines list 可查看所有可用的 pipeline 类型。Prompt
如何抓取其他网站
更换 pipeline 类型即可。CLI 以每个 pipeline 采集的内容命名,因此不需要查找dataset_id。
查看当前完整集合:
bdata search,没有预构建抓取器的页面请使用 bdata scrape。
安装技能后,您无需自己选择类型。只需说明想要的数据,智能体会把网站匹配到对应的 pipeline:
Prompt
智能体会配置些什么
它们不是互相替代的方案。参见如何搭配使用。
前提条件
- 一个 Bright Data 账户。新账户每月获得 5,000 个免费信用额度,无需信用卡
- 一个具备终端访问能力的编码智能体:Claude Code、Cursor、Codex,或技能生态支持的 40+ 个智能体中的任意一个
如何让智能体读到全部文档
把智能体指向llms.txt,这是按照 llms.txt 标准组织的 Bright Data 全部文档页面索引。每个条目都链接到页面的 .md 版本,因此智能体读到的是干净的 markdown,无需解析 HTML。
Prompt
llms.txt 是索引,适合作为实时智能体会话的默认选择。llms-full.txt 是全部文档合并成的单个文件,面向 RAG 管道和长上下文注入,而非交互式使用。
希望智能体实时查询文档而不是加载文件?Docs MCP 将本文档以可搜索的 MCP 资源形式暴露,智能体可在自身推理循环中检索页面。它与下文的 Bright Data MCP 是两个不同的服务:Docs MCP 读取文档,Bright Data MCP 访问实时网络。
在搭建检索管道而非实时智能体会话?请使用 llms-full.txt,即以单个 markdown 文件形式提供的完整文档:
如何安装 Bright Data 技能
技能是定义在SKILL.md 文件中的可复用指令集,为智能体内置 Bright Data API 知识以及通过 Bright Data CLI 执行操作的命令。一条命令即可安装,并自动检测您已安装的智能体:
bdata,因此第一步中的全局安装是它们能够工作的前提。如果 bdata 不在 PATH 中,技能的 command -v bdata 检查会失败。
确认安装成功:
npx skills add brightdata/skills 并回答作用域提示。
该技能包涵盖搜索、抓取、结构化提取、SDK、代理、Scraper Studio 与 MCP 编排。您最先会用到的是:
运行
npx skills add brightdata/skills --list 查看当前完整集合。
安装完成后,智能体会直接调用它们:
安装到指定的智能体
- Claude Code
- Cursor
- Codex
- 一次安装到所有智能体
- 其他任意智能体
.claude/skills/,加上 -g 则安装到 ~/.claude/skills/。Claude Code 会在下一个会话中发现它们。可用 npx skills list -a claude-code 验证。-g 即可跨项目全局安装。
管理已安装的技能
SKILL.md 及其可运行脚本,位于 github.com/brightdata/skills。新技能会持续加入,欢迎 star 该仓库以便关注。
如何连接 Bright Data MCP Server
Bright Data MCP Server 通过 60+ 个用于搜索、抓取、结构化提取和浏览器自动化的工具,为智能体提供实时网页访问能力。它运行在 Web Unlocker API 上,因此每个请求都会处理代理轮换、反机器人挑战和验证码求解。 下面的每段配置都会把 API 密钥写入智能体的配置文件。这类文件常被提交到版本控制中,因此请像对待其他机密一样对待该密钥。若想完全避免在文件中留存长期密钥,该服务器也支持 OAuth 2.1,由用户在浏览器中登录。Extract the Bright Data overview section from LinkedIn 的提示词试一下。
它有两个版本。远程服务器完全托管,无需任何配置。本地服务器可自托管,适用于本地部署或私有云。两者的说明参见 MCP Server 概览,其他客户端参见集成指南。
技能 MCP 还是两者都用
技能加 CLI 是默认组合。技能承载知识:哪个 Bright Data 产品适合当前任务、如何进行身份验证、如何处理分页和错误。CLI 负责执行。在智能体真正运行命令之前,两者都不会产生实时请求。 当智能体没有终端时,MCP Server 才是关键。它把同样的能力以工具形式暴露在智能体自身的循环中,这是托管助手或无法调用 shell 的客户端唯一可行的路径。 本页把终端访问列为前提条件,因此这里的 MCP 是可选项。当您希望在工具循环中而不是通过 shell 获得实时网页访问时,再加上它。常见问题
我需要全局安装任何东西吗?
我需要全局安装任何东西吗?
不需要。
npx skills add brightdata/skills 和 npx -y @brightdata/mcp 都是按需获取的,因此没有需要维护的全局依赖。Bright Data CLI 也可以通过 npx 运行:npx -p @brightdata/cli brightdata --version。MCP Server 使用同一个免费套餐吗?
MCP Server 使用同一个免费套餐吗?
是的。MCP Server 运行在 Web Unlocker API 上,因此从账户级免费套餐的每月 5,000 个信用额度中扣除,且来自同一个共享额度池。在团队账户中,该额度池由账户内所有用户共享。
MCP Server 需要用户名吗?
MCP Server 需要用户名吗?
不需要。远程和本地 MCP Server 都只使用 API 密钥进行身份验证。形如
brd-customer-{customer_id}-zone-{zone_name} 的用户名用于原生代理访问,与 MCP 无关。如果第三方工具要求填写用户名,请留空。支持哪些智能体?
支持哪些智能体?
技能可在开放智能体技能生态的 40+ 个智能体中使用,包括 Claude Code、Cursor 和 Codex。MCP Server 适用于任何兼容 MCP 的客户端。
llms.txt 适用于任何能够获取 URL 的工具。我的智能体能为没有预构建抓取器的网站构建抓取器吗?
我的智能体能为没有预构建抓取器的网站构建抓取器吗?
可以。给它一个目标 URL 和一句描述所需字段的说明,Bright Data CLI 就会通过 Scraper Studio 生成抓取器。完整的构建、运行与自我修复循环的可复制提示词参见 Scraper Studio 编码智能体提示词。
后续步骤
选择产品
将目标网站匹配到合适的 Bright Data 产品,然后直接开始第一个请求。
用提示词构建抓取器
可复制的 Claude Code、Cursor 和 Codex 提示词,用于构建、运行并自我修复抓取器。
Bright Data CLI
在终端中进行抓取、搜索、管理 zone 并控制远程浏览器。