Skip to main content

全局选项

这些标志适用于任何命令:

brightdata login

使用 Bright Data 进行身份验证。默认在浏览器中打开 OAuth。
首次登录时,CLI 会自动创建 cli_unlockercli_browser 代理区域并设置合理的默认值。

brightdata logout

清除存储的凭证。

brightdata scrape <url>

使用 Bright Data 的 Web Unlocker 抓取任何 URL。自动处理验证码、JavaScript 渲染和反爬虫保护。

brightdata search <query>

通过 Bright Data 的 SERP API 搜索 Google、Bing 或 Yandex。Google 返回带有有机结果、广��、相关问题和相关搜索的结构化 JSON。Bing 和 Yandex 默认返回 markdown。

brightdata pipelines <type> [params...] [options]

从 40 多个平台提取结构化数据。触发异步收集作业,轮询直到结果准备就绪,然后返回数据。

支持的平台

随时在终端中运行 brightdata pipelines list 查看所有可用类型。

brightdata scraper

从终端构建、运行和维护自定义 Bright Data Scraper Studio 爬虫。每个爬虫由一个 Collector ID(c_* 字符串)标识,该 ID 在多次运行和自我修复之间保持稳定。

brightdata scraper create <url> <description>

使用 Bright Data 的 AI Agent 根据自然语言描述构建爬虫。返回一个 Collector ID。
AI 生成通常耗时 5 到 15 分钟,复杂目标可能长达 25 分钟。

brightdata scraper run <collector_id> [url]

在一个或多个 URL 上运行爬虫并返回数据。CLI 会先尝试实时模式,当某次运行超过实时模式的页面加载上限时,自动回退到批处理模式。

brightdata scraper heal <collector_id> <prompt>

通过 AI 自我修复就地修复现有爬虫。Collector ID 不变。默认情况下,heal 会停在批准关口,返回 status: "awaiting_approval"preview_result

brightdata scraper approve <collector_id>

提交等待批准的修复,或使用 --reject 拒绝它。
自我修复的流程是:运行、检查、healapprove、重新运行。完整演练参见 Scraper Studio CLI 快速开始scraper healscraper approve 在 CLI v0.3.1 中加入。

brightdata status <job-id>

检查异步快照作业的状态(来自 --async 抓取或管道收集)。

brightdata zones

列出并检查 Bright Data 代理区域。

brightdata budget

查看账户余额和按区域的成本/带宽。只读。

brightdata config

查看和管理 CLI 配置。

brightdata init

交互式设置向导。引导完成身份验证、区域选择和默认配置。

brightdata skill

将 Bright Data AI 代理技能安装到编码代理中(Claude Code、Cursor、Copilot 等)。 可用技能:searchscrapedata-feedsbright-data-mcpbright-data-best-practices