selenium 使用

selenium

selenium：可以让浏览器完成相关自动化的操作
环境安装：
- pip install selenium
编码流程：
- 导包
- 创建某一款浏览器对象
- 制定相关的行为动作

from selenium import webdriver

from time import sleep

bro = webdriver.Chrome(executable_path=r'C:\Users\old-boy\Desktop\爬虫+数据\爬虫_day04\chromedriver.exe')

sleep(3)

bro.get('https://www.baidu.com/')

sleep(3)

#find系列的函数可以帮助我们定位到相关的标签

text_input = bro.find_element_by_id('kw')

#向文本框中录入一个关键字

text_input.send_keys('中国')

sleep(3)

btn = bro.find_element_by_id('su')

btn.click()

sleep(3)

#获取当前浏览器显示的页面源码数据（动态加载的数据）

page_text = bro.page_source

print(page_text)

bro.quit()

#爬取更多的电影详情数据（豆瓣）

bro = webdriver.Chrome(executable_path=r'C:\Users\old-boy\Desktop\爬虫+数据\爬虫_day04\chromedriver.exe')

bro.get('https://movie.douban.com/typerank?type_name=%E7%88%B1%E6%83%85&type=13&interval_id=100:90&action=')

sleep(3)

bro.execute_script('window.scrollTo(0,document.body.scrollHeight)')

sleep(3)

bro.execute_script('window.scrollTo(0,document.body.scrollHeight)')

sleep(3)

bro.execute_script('window.scrollTo(0,document.body.scrollHeight)')

#获取浏览器当前的页面源码数据

page_text = bro.page_source

with open('douban.html','w',encoding='utf-8') as fp:

    fp.write(page_text)

sleep(3)

bro.quit()

phantomJs:浏览器（无可视化界面）

#爬取更多的电影详情数据（豆瓣）

bro = webdriver.PhantomJS(executable_path=r'C:\Users\old-boy\Desktop\爬虫+数据\tools\phantomjs-2.1.1-windows\bin\phantomjs.exe')

bro.get('https://movie.douban.com/typerank?type_name=%E7%88%B1%E6%83%85&type=13&interval_id=100:90&action=')

sleep(3)

bro.save_screenshot('./1.png')

bro.execute_script('window.scrollTo(0,document.body.scrollHeight)')

sleep(3)

bro.execute_script('window.scrollTo(0,document.body.scrollHeight)')

sleep(3)

bro.execute_script('window.scrollTo(0,document.body.scrollHeight)')

bro.save_screenshot('./2.png')

#获取浏览器当前的页面源码数据

page_text = bro.page_source

with open('douban.html','w',encoding='utf-8') as fp:

    fp.write(page_text)

sleep(3)

bro.quit()

谷歌无头浏览器

from selenium.webdriver.chrome.options import Options

chrome_options = Options()

chrome_options.add_argument('--headless')

chrome_options.add_argument('--disable-gpu')

bro = webdriver.Chrome(executable_path=r'C:\Users\old-boy\Desktop\爬虫+数据\爬虫_day04\chromedriver.exe',chrome_options=chrome_options)

sleep(3)

bro.get('https://www.baidu.com/')

sleep(3)

#find系列的函数可以帮助我们定位到相关的标签

text_input = bro.find_element_by_id('kw')

#向文本框中录入一个关键字

text_input.send_keys('中国')

sleep(3)

btn = bro.find_element_by_id('su')

btn.click()

sleep(3)

#获取当前浏览器显示的页面源码数据（动态加载的数据）

page_text = bro.page_source

print(page_text)

bro.quit()

登录qq空间

bro = webdriver.Chrome(executable_path=r'C:\Users\old-boy\Desktop\爬虫+数据\爬虫_day04\chromedriver.exe')

bro.get('https://qzone.qq.com/')

sleep(3)

#注意：如果想要通过find系列函数去定位某一个iframe标签下的子标签的话，一定要使用如下操作：

bro.switch_to.frame('login_frame')#参数表示的是iframe标签的id属性值

bro.find_element_by_id('switcher_plogin').click()

sleep(3)

bro.find_element_by_id('u').send_keys('592888935')

bro.find_element_by_id('p').send_keys('hmw112626')

sleep(3)

bro.find_element_by_id('login_button').click()

print(bro.page_source)

sleep(3)

bro.quit()

selenium 使用的更多相关文章

Python爬虫小白入门（四）PhatomJS+Selenium第一篇
一.前言在上一篇博文中,我们的爬虫面临着一个问题,在爬取Unsplash网站的时候,由于网站是下拉刷新,并没有分页.所以不能够通过页码获取页面的url来分别发送网络请求.我也尝试了其他方式,比如下拉 ...
Selenium的PO模式（Page Object Model）[python版]
Page Object Model 简称POM 普通的测试用例代码: .... #测试用例 def test_login_mail(self): driver = self.driver driv ...
selenium元素定位篇
Selenium webdriver是完全模拟用户在对浏览器进行操作,所有用户都是在页面进行的单击.双击.输入.滚动等操作,而webdriver也是一样,所以需要我们指定元素让webdriver进行单 ...
selenium自动化基础知识
什么是自动化测试? 自动化测试分为:功能自动化和性能自动化功能自动化即使用计算机通过编码的方式来替代手工测试,完成一些重复性比较高的测试,解放测试人员的测试压力.同时,如果系统有不份模块更改后,只要 ...
幼儿园的 selenium
from selenium import webdriver *固定开头 b=webdriver.Firefox() *打开火狐浏览器 browser. ...
使用selenium编写脚本常见问题（一）
前提:我用selenium IDE录制脚本,我用java写的脚本,如果大家想看的清楚明白推荐java/Junit4/Webdriver 我用的是java/TestNG/remote control 1 ...
关于selenium RC的脚本开发
第一.需要录制脚本,找个我也不说了.就是在firefox下下载一个selenium-IDE并且安装. 第二.在工具里找到selenium-IDE点击运行. 第三.默认是红色按钮点击状态的,接下来随便你 ...
基于python的selenium自动化测试环境安装
1. Python2安装官方网站:https://www.python.org/downloads/ (python3或新版本已经默认集成了pip包和path,安装的时候打勾就行,可以直接跳过下面第 ...
Selenium+python 配置
1. 安装python, www.python.org. 下载最新的python,应该是32位的.注意配置环境变量. 2. 安装PIP(pip是一个以Python计算机程序语言写成的软件包管理系统). ...
selenium 使用action进行鼠标，键盘操作
 <html> <head> <title>Set Timeout</title> <script&g ...

随机推荐

springMVC_02hello案例
1.导入jar包 commons-logging-1.1.1.jar jackson-annotations-2.5.4.jar jackson-core-2.5.4.jar jackson-data ...
Spring AOP原理(续)
十二.AOP 1. 说出Spring的通知类型有哪些? spring共提供了五种类型的通知: 通知类型接口描述 Around 环绕通知 org.aopalliance.intercept.Meth ...
Python高级特性：迭代
迭代的目的是实现遍历出一个可迭代对象的元素,即for循环基本语法 : for ... in ... 首先只有可迭代对象才可以迭代,判断一个对象是不是可以迭代的方法如下: >>> f ...
VysorPro助手
Vysor是一款非常强大而又好用的Android远程显示及控制软件,有Chrome插件版.Windows客户端版和Mac版,是Android开发和测试人员的必备神器.其中Windows客户端版相对Ch ...
Testlink1.9.17使用方法( 第三章初始配置[配置用户、产品] ）
第三章初始配置(配置用户.产品) 一. 设置用户 QQ交流群:585499566 在TestLink系统中,每个用户都可以维护自己的私有信息.admin可以创建用户,但不能看到其它用户的密码.在用户 ...
(网页)HTML5
1.html5基本格式: <!DOCTYPE> --> 文档类型声明. <html lang="zh-cn"> --> 表示html文档开始 & ...
SQL中触发器的使用
创建触发器是特殊的存储过程,自动执行,一般不要有返回值类型: 1.后触发器 (AFTER,FOR)先执行对应语句,后执行触发器中的语句 2.前触发器并没有真正的执行触发语句(insert,up ...
[20181130]control file sequential read.txt
[20181130]control file sequential read.txt --//昨天上午探究了大量控制文件读的情况,链接:http://blog.itpub.net/267265/vie ...
web前端（10）—— 浮动，清除默认样式
文档流 web页面和ps等设计软件有本质的区别,web 网页的制作,是个“流”,从上而下 ,像 “织毛衣”,就跟编程语言一样,都是由上而下而设计软件 ,想往哪里画东西,就去哪里画文档流带来的最明显 ...
Sql2012如何将远程服务器数据库及表、表结构、表数据导入本地数据库
1.第一步,在本地数据库中建一个与服务器同名的数据库 2.第二步,右键源数据库,任务>导出数据,弹出导入导出提示框,点下一步继续 3.远程数据库操作,确认服务器名称(服务器地址).身份验证(输入 ...

selenium 使用

selenium

phantomJs:浏览器（无可视化界面）

谷歌无头浏览器

登录qq空间

selenium 使用的更多相关文章

随机推荐

热门专题