网络状态 全球地区 support@rola-ip.co 中文 (CN)

自定义解析器

  • 设置自定义解析指令以提取公司需要的数据
  • 接收即用型、解析后数据
  • 提供 XPath 和 CSS 选择器

自定义解析器是爬虫 API 的一项功能

免费试用
设置自定义解析指令

根据您编写的自定义解析指令,解析器将从 HTML 中挑出必要的信息,并将其转换为可读的 JSON 格式。

从任何网站获取解析后数据

在数据解析方面不再有任何限制。自定义解析器解决了一些工具无法解析特定目标数据的常见限制。

免除解析器维护

有了 Rola IP 的自定义解析器功能,您就无需担心托管和维护自己的解析基础架构——我们会完成这项工作。

什么是自定义解析器?

自定义解析器是爬虫 API 的一项免费功能,能让您自定义在原始 HTML 抓取结果上执行的解析和数据转化逻辑。

第 1 步

用户向 API 提交作业指令(目标 URL 和解析指令)。

第 2 步

作业描述被转发到爬虫 API,在网站和 API 之间发起 HTTPS 请求。

第 3 步

爬虫 API 将 HTML 数据和解析指令一起转发给自定义解析器。

第 4 步

自定义解析器将数据从 HTML 转换为 JSON 格式,并转发到用户的数据库或云存储。

具有自定义解析器功能的爬虫 API

网络爬虫 API

可从大多数网站收集可扩展的实时数据。可定制的请求参数、JavaScript 渲染、方便交付。

最适用于:网站更改监控、欺诈防护、旅行费用监控。

49 美元起/月

来自客户经理的寄言

自定义解析器是对爬虫 API 工具系列的很好补充。通过利用这一额外功能,您可以自始至终获得极致简单的抓取体验。

— Rola IP 客户经理

使用自定义解析器是处理数据的一种超级有效的方式。它不仅能够提供解析过的数据,而且还允许您只检索需要的特定数据——不多不少。

— Rola IP 客户经理

常见问题

自定义解析器的用途?

Rola IP 的自定义解析器是一个将数据从原始数据转为结构化的工具。根据预先写好的规则,解析器将选择必要的信息,并转换成可读的 JSON 格式。

我需要成为爬虫 API 的客户才能使用自定义解析器吗?

自定义解析器是爬虫 API 的免费附加功能。您需要订阅爬虫 API 套餐,才能使用自定义解析功能。

XPath 和 CSS 选择器之间有什么区别?

XPath 和 CSS 选择器是在 HTML 或 XML 文档中选择特定元素的两种不同方法。CSS 选择器更容易使用,而 XPath 表达式更强大,但使用难度也比较高。

选择 Rola IP®,业务更上一层楼

立即开始