前言
有时候通过元素的属性的查找页面上的某个元素,可能不太好找,这时候可以从源码中爬出想要的信息。selenium 的 page_source 可以获取到页面源码。
1.selenium 的 page_source 可以直接返回页面源码
2.重新赋值后打印出来
这里可以使用正则匹配到你想要的数据,比如我这里想要所有的链接,
本文介绍了一种利用Selenium的page_source功能来获取网页源码的方法,并通过正则表达式提取所需信息,如所有链接等。
前言
有时候通过元素的属性的查找页面上的某个元素,可能不太好找,这时候可以从源码中爬出想要的信息。selenium 的 page_source 可以获取到页面源码。
1.selenium 的 page_source 可以直接返回页面源码
2.重新赋值后打印出来
这里可以使用正则匹配到你想要的数据,比如我这里想要所有的链接,
4万+
134

被折叠的 条评论
为什么被折叠?
&spm=1001.2101.3001.5002&articleId=77573443&d=1&t=3&u=ea6845e191ea45b6bb4054a131c4d055)