Skip to main content
本文仅适用于 IDE Normal V2 版本,该版本供内部使用,对客户不开放。

介绍

collect 和 parse 命令已被移除。数据将从 parser 代码中以对象或数组的形式返回,并会自动保存到输出中:
新增了命令来提供从交互代码访问数据的能力:tag_htmltag_requesttag_graphql 此外,一些现有命令已更新:tag_responsetag_sitemaptag_all_responses。更多详情请参阅 IDE 文档 当使用任意 tag 命令时,你可以提供自定义名称。然后你可以在 parser 代码中使用 parser.YOUR_KEY 来访问数据。 对于 tag_html,当前浏览器位置 URL 将保存到 parser.YOUR_KEY_url 下。 对于只需要单个 tag_html 的简单场景,它可以省略,并将自动保存为 parser.page。
有时,需要在交互代码中获取解析后的数据,并使用它发出请求。请查看以下示例:

多结果

要收集多个结果,可以从 parser 代码返回数组。

重新解析(Reparse)

Reparse 是一项新功能,允许重新解析已收集的数据。当你想修改 parser 代码但不想重新运行整个交互代码时,它会非常有用:

next_stagererun_stage

当 scraper 有多个步骤时,parser 代码仅能在最后一步使用。其他步骤只能使用 next_stage。要从页面解析内容,需要使用 load_html

基本 PDP 抓取器

多次导航示例

多个 tag_response