粘贴 HTML 并输入 XPath 表达式,查看节点文本、属性、元素 HTML 或数值与布尔结果,便于调试爬虫页面提取规则。
怎么用
- 在左侧输入 HTML。
- 在中间填写 XPath,例如 //a 或 //span[@class="price"]。
- 右侧默认显示节点文本;需要标签结构时切换为元素 HTML。
小贴士
- 提取字段值时使用节点文本;提取链接或整块标记时使用元素 HTML。
- 浏览器复制的 XPath 多为绝对路径,建议改写为基于 class / id 的稳定表达式。
- XPath 按文档树选取节点,与正则的字符扫描不同。
相关工具:
正则测试、HTML格式化