python+selenium+chromedriver实现爬⾍⽰例代码
下载好所需程序
1.Selenium简介
Selenium是⼀个⽤于Web应⽤程序测试的⼯具,直接运⾏在浏览器中,就像真正的⽤户在操作⼀样。
2.Selenium安装
⽅法⼀:在Windows命令⾏(cmd)输⼊pip install selenium即可⾃动安装,安装完成后,输⼊pip show selenium可查看当前的版本
⽅法⼆:直接下载selenium包:
Pychome安装selenium如果出现⽆法安装,参考以下博客
3.禁⽌⾕歌浏览器⾃动更新
搜索本地:管理⼯具-服务-Google⾃动更新服务-选择禁⽌
安装浏览器对应的驱动driver
我这⾥⽤的是⾕歌,选择对应的驱动版本
驱动的下载地址如下:
win32、win64的都下载win32.zip 的
将下载的chromedriver 进⾏解压,并将⽂件复制或移动到,浏览器快捷⽅式所在⽬录。
环境变量配置
1.Python 环境配置
2.chromedriver 环境配置
chrome浏览器电脑版下载
3.pychrome 的python 环境指向⾃⼰电脑安装好的python
注意:将下载好的 驱动放在Python 的安装路径下的Scripts ⾥⾯,同时将Scripts 路径添加到PATH 中,这样每次运⾏python 的时候就会⾃动加载驱动
代码实现
#已经准备环境:webdriver:Google已经安装好;环境变量配置好;pip install selenium;
#selenium是⼀个包,包有很多对象,对象有属性,⽅法。
from selenium import webdriver
browser=webdriver.Chrome()#打开浏览器
url="news.qq/zt2020/page/feiyan.htm#/global?nojump=1"#获取数据的地址
#请求浏览器内容:请求⽅式:get,post,token
<(url)
#css选择器,id选择器:#开头,class选择器:.开头,标签选择器:p,span,div。
coronavirus_countent=browser.find_element_by_class_name('d')#定位到class选择器d这个内容
print(coronavirus_countent)#查看内容,session,⼀种缓存机制,通过浏览器解析,然后缓存的内容
# <webelement.WebElement (session="a1aa22161543b44f599e97b35dbc1ac5", element="fe645993-43cb-46cf-83a7-2488dd3d838a")> print()#查看当前css.class中的d的内容
coronavirus_time=browser.find_element_by_class_name('ml')#定位到class选择器d这个内容
print()
coronavirus_data=browser.find_element_by_class_name('nowConfirm')#定位到class选择器d这个内容
print("=======")
print()
print("=====nowConfirm下⾯的字内容")
coronavirus_sub=coronavirus_data.find_element_by_class_name('addnum')
print()
browser.quit()
到此这篇关于python+selenium+chromedriver实现爬⾍⽰例代码的⽂章就介绍到这了,更多相关python selenium chromedriver 爬⾍内容请搜索以前的⽂章或继续浏览下⾯的相关⽂章希望⼤家以后多多⽀持!
版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系QQ:729038198,我们将在24小时内删除。
发表评论