何时使用 Search?
当您需要在单次低延迟调用中取回少量记录时,使用 Search:- 实时查询,例如线索一进入 CRM 就立即增强。
- 将实时记录输入 AI agent 或 LLM 应用。
- 按姓名、职位、公司或地区进行销售勘探。
- 购买前抽样数据集,搭配
"sort": "random"。 - 任何需要在一次调用中取回最多 1,000 条记录的工作负载。
运行您的第一个 Search 查询
向/datasets/search/:dataset_id 发送 POST 请求,并带上一个 filter 对象。下面的示例在 LinkedIn 人物档案数据集中查询 name 包含 Egor 的记录:
Search 支持哪些数据集?
Search 处于 alpha 阶段,目前支持三个 LinkedIn 数据集。其他任何数据集请使用 Filter。Amazon 数据集即将推出。更多数据集将在 2026 年第三季度逐步走向正式发布(GA)。向 Search 传入不受支持的
dataset_id 会返回 404。如何进行身份验证?
Search 使用 Bearer token 身份验证。在Authorization 请求头中传入您的 API Key:
Search 接受哪些参数?
Search 返回什么?
如何排序和分页?
设置sort 控制排序,并使用返回的 search_after 游标翻页。
使用随机排序抽样数据集
使用"sort": "random" 提取有代表性的样本,例如在购买数据集之前:
使用 search_after 翻页
设置"sort": "default" 以在响应中获得 search_after 游标。请求第一页:
search_after 数组传回以获取下一页:
按自定义字段排序
传入由”字段到方向”对象组成的数组,按指定字段排序:Search 的费用是多少?
Search 的费用为 $2.5 CPM(每返回 1,000 条记录),与市场价格相同。筛选返回 0 条记录时不收费。Search 可能返回哪些错误?
常见问题
Search 支持 CSV 或 JSON 文件上传吗?
不支持。Elasticsearch 无法在查询时读取外部文件。要按 CSV 或 JSON 文件中的成千上万个值进行筛选,请使用 Filter 端点。Search 一次调用能返回多少条记录?
Search 最适合每次调用最多 1,000 条记录。如需更大规模的提取,请使用 Filter,它基于快照并支持批量导出。为什么 Search 和 Filter 返回的结果略有不同?
两个端点使用不同的引擎。Elasticsearch 对文本的分词方式与快照引擎不同,因此自由文本匹配可能存在差异。在自由文本字段上,建议优先使用includes 运算符而非 =。