当我们爬取不同的网站是,每个网站页面的实现方式各不相同,我们需要对每个网站都进行分析。那是否有一些通用的分析方法?我分享下自己爬取分析的“套路”。在某个网站上,分析页面以及抓取数据,我用得最多的工具是Chrome开发者工具。
Chrome开发者工具是一套内置于Google Chrome 中的 Web 开发和调试工具,可用来对网站进行迭代、调试和分析。因为国内很多浏览器内核都是基于Chrome 内核,所以国产浏览器也带有这个功能。例如:UC浏览器、QQ浏览器、360浏览器等。
接下来,我们来看看Chrome开发者工具一些比较牛逼的功能。
元素面板(Elements)
通过元素(Element)面板,我们能查看到想抓取页面渲染内容所在的标签、使用什么CSS属性(例如: class=\"middle\")等内容。例如我想要抓取我知乎主页中的动态标题,在网页页面所在处上右击鼠标,选择“检查”,可进入Chrome开发者工具的元素面板。
<img src=\"wp-content/uploads/2022/02/https://www.173top.cn/wp-content/uploads/2022/02/1645375675-20220220164755-621270bb299c9.png
来源:https://www.cnblogs.com/qshhl/p/14744816.html
图文来源于网络,如有侵权请联系删除。