阅读(2771) (0)

scrapy 2.3 预渲染JavaScript

2021-06-16 16:02:18 更新

在从其他请求中获取数据的网页上,复制包含所需数据的请求是首选方法。这项工作通常是值得的:结构化的、完整的数据,最少的解析时间和网络传输。

然而,有时很难重现某些请求。或者你可能需要一些没有请求可以提供给你的东西,比如网页的屏幕截图,就像在网页浏览器中看到的那样。

在这些情况下,使用 Splash JavaScript呈现服务,以及 scrapy-splash 实现无缝集成。

splash返回为html DOM 一个网页,这样你就可以用 selectors . 它通过 configuration 或 scripting.

如果您需要Splash提供的以外的东西,例如从python代码即时与DOM交互而不是使用以前编写的脚本,或者处理多个Web浏览器窗口,您可能需要 use a headless browser 相反。