我正在尝试构建一个网络爬虫。
我需要两件事:
- 将 HTML 转换为 DOM 对象。
- 按需执行现有的 JavaScript。
此外,我需要一个选项来按需执行额外的 JavaScript(在诸如:等事件上
onMouseOver
)onMouseClick
首先,我找不到好的文档来源。我搜索了Webkit 主页,但找不到该软件包用户的太多信息,也没有有用的代码示例。另外,在一些论坛中,我看到了不要将 Webkit 接口用于爬虫,而是直接使用 DOM 和 Javascript 内部包的说明。 我正在搜索文档和代码示例。
此外,关于正确使用的任何建议。
工作环境:
- 操作系统:Windows
- 朗:C++