我采用的是Python来使用selenium库,同时java也可以使用,但不如python操作起来方便。下文都会以python的操作为例子,整理我学习selenium过程中收集到的方法。

一:安装

首先python先要安装selenium:

pip install Selenium 

第二步,下载对应的浏览器驱动,我这里用chrome(推荐),对应的驱动下载地址:http://chromedriver.storage.googleapis.com/index.html

驱动版本要与chrome版本对应,但是建议直接用最新版的chrome,然后驱动也下载目前最新的就可以了。然后把下载下来的chromedriver.exe文件放到环境变量的路径下,确保python能正确调用到。

二:基础用法

导入:

from selenium import webdriver

1.获取driver对象

driver = webdriver.Chrome()

如果要设置参数,则要创建一个option对象并作为参数传入构造函数中:

chromeOptions = webdriver.ChromeOptions()
chromeOptions.add_argument('disable-infobars') #取消浏览器打开时显示的正在监控提示
chromeOptions.add_argument('--user-agent=Mozilla/5.0 (Windows NT 6.1; WOW64; rv:34.0) Gecko/20100101 Firefox/34.0') #添加User-Agent
chromeOptions.add_argument("--proxy-server=http://127.0.0.1") #添加代理chromeOptions.add_argument('--headless') #浏览器后台运行模式
driver = webdriver.Chrome(options=chromeOptions)

2.基本操作

driver.maximize_window() #浏览器最大化 (默认是小窗口)
driver.minimize_window() #浏览器最小化
driver.set_page_load_timeout(20) #超时时间,如果设置了,超过时间会自动停止
driver.get("http://www.baidu.com") #访问网站
driver.refresh() #刷新网站
js='window.open("https://www.baidu.com");' #通过执行js,开启一个新的窗口
driver.execute_script(js)
driver.switch_to.window(driver.window_handles[1])#切换浏览器中的窗口,window_handles返回当前窗口集合,这里代表切换到第二个窗口,如果不存在第二个窗口,会报错
driver.getTitle() #获取当前窗口标题名driver.current_window_handle #获得当前窗口对象driver.current_url #当前urldriver.page_source #当前页面源代码
driver.close() #关闭当前窗口
driver.quit() #关闭整个浏览器

三.查找元素

基础查找

driver.get("https://www.baidu.com")
kw = find_element_by_id("kw") #通过id查找html元素, 对应百度搜索框
su = driver.find_element_by_id("su") #点击搜索按钮
kw.send_keys("搜索一下") #元素可以使用该方法自动填充输入框的内容
su.click() #元素可以使用该方法点击自身

#其他查找方法
find_element_by_name() #通过name属性查找html元素
find_element_by_class_name() #通过class属性中存在的值查找html元素
find_element_by_tag_name() #通过查找标签找到元素,如传入"p", "input"等,不推荐使用

#还有其他很多方法,以上均返回单个元素,element加上s则为返回多个符合条件的元素
find_elements_by_name()

进阶查找

一. xpath查找

xpath是XML路径语言,它可以用来确定xml文档中的元素位置,通过元素的路径来完成对元素的查找。HTML就是XML的一种实现方式,所以xpath是一种非常强大的定位方式。

1.1 Xpath的绝对路径定位

利用html标签名的层级关系来定位元素的绝对路径,下标数字可以在多个同样标签中选择,一般从<html>标签开始依次往下进行查找。如:

find_element_by_xpath("/html/body/div[1]/form/span[1]/input")

1.2 Xpath利用元素属性与值定位

find_element_by_xpath("//input[@id='kw']")
find_element_by_xpath("//*[@name='wd']")

1.3 混合定位

find_element_by_xpath("//form[@id='form']/span/input")

二. CSS选择器

driver.find_element_by_css_selector(".btn")
driver.find_element_by_css_selector("#su")

通过属性或组合方式:

driver.find_element_by_css_selector("input[name='kw']").send_keys("Python")
driver.find_element_by_css_selector("span.bg.btn_default>input#su").click()

四. 鼠标键盘操作

selenium提供了ActionChains类来处理鼠标、键盘事件,如鼠标移动,点击,拖拽,键盘按下抬起等。需要导入如下

from selenium.webdriver.common.action_chains import ActionChains
ActionChains方法列表:
click(on_element=None) ——单击鼠标左键
click_and_hold(on_element=None) ——点击鼠标左键,不松开
context_click(on_element=None) ——点击鼠标右键
double_click(on_element=None) ——双击鼠标左键
drag_and_drop(source, target) ——拖拽到某个元素然后松开
drag_and_drop_by_offset(source, xoffset, yoffset) ——拖拽到某个坐标然后松开
key_down(value, element=None) ——按下某个键盘上的键
key_up(value, element=None) ——松开某个键
move_by_offset(xoffset, yoffset) ——鼠标从当前位置移动到某个坐标
move_to_element(to_element) ——鼠标移动到某个元素
move_to_element_with_offset(to_element, xoffset, yoffset) ——移动到距某个元素(左上角坐标)多少距离的位置
perform() ——执行链中的所有动作
release(on_element=None) ——在某个元素位置松开鼠标左键
send_keys(*keys_to_send) ——发送某个键到当前焦点的元素
send_keys_to_element(element, *keys_to_send) ——发送某个键到指定元素

  • 链式写法:
su = find_element_by_id("su")
ActionChains(driver).move_to_element(su).click(su).perform()

  • 分步写法
su = find_element_by_id("su")
actions = ActionChains(driver)
actions.move_to_element(su)
actions.click(su)
actions.perform()

控制键盘示例:

ActionChains(driver).key_down(Keys.CONTROL, enter).key_up(Keys.CONTROL).perform() #按下Ctrl键然后松开

 执行JS:

driver.execute_script("window.scrollTo(0,100)")
driver.execute_script("document.getElementById(\"kw\").value=\"selenium\"")

五. 其他

禁用图片及JS加载:

from selenium import webdriver
options = webdriver.ChromeOptions()
prefs = {
    'profile.default_content_setting_values': {
         'images': 2,
         'javascript': 2,
    }
} #2是禁用, 1是允许
options.add_experimental_option('prefs', prefs)
driver = webdriver.Chrome(chrome_options=options)    

隐藏window.navigator.webdriver特征参数 (有时候能反爬)

from selenium.webdriver import Chrome
from selenium.webdriver import ChromeOptions

option = ChromeOptions()
option.add_experimental_option('excludeSwitches', ['enable-automation'])
driver = Chrome(options=option)

Selenium使用方法整理的更多相关文章

  1. 【AS3】Flash与后台数据交换四种方法整理

    随着Flash Player 9的普及,AS3编程也越来越多了,所以这次重新整理AS3下几种与后台数据交换方法.1.URLLoader(URLStream)2.FlashRemoting3.XMLSo ...

  2. 常用js方法整理common.js

    项目中常用js方法整理成了common.js var h = {}; h.get = function (url, data, ok, error) { $.ajax({ url: url, data ...

  3. 在WebBrowser中执行javascript脚本的几种方法整理(execScript/InvokeScript/NavigateScript) 附完整源码

    [实例简介] 涵盖了几种常用的 webBrowser执行javascript的方法,详见示例截图以及代码 [实例截图] [核心代码] execScript方式: 1 2 3 4 5 6 7 8 9 1 ...

  4. 项目中常用js方法整理common.js

    抽空把项目中常用js方法整理成了common.js,都是网上搜集而来的,大家一起分享吧. var h = {}; h.get = function (url, data, ok, error) { $ ...

  5. Ruby数组方法整理

    数组方法整理 方法列表: all().any().none()和one():测试数组中的所有或部分元素是否满足给定条件.条件可以是语句块中决定,也可以是参数决定 append():等价于push() ...

  6. Vue2.x源码学习笔记-Vue实例的属性和方法整理

    还是先从浏览器直观的感受下实例属性和方法. 实例属性: 对应解释如下: vm._uid // 自增的id vm._isVue // 标示是vue对象,避免被observe vm._renderProx ...

  7. Tomcat 多项目部署方法整理

    Tomcat 多项目部署方法整理 说明:tomcat-deploy-aaa和tomcat-deploy-bbb是两个不同的web项目,为了方便以下简称aaa和bbb,请先自行创建并跑通 导航: NO1 ...

  8. python+selenium安装方法

    一.准备工具: 下载 python[python 开发环境] http://python.org/getit/ 下载 setuptools [python 的基础包工具] http://pypi.py ...

  9. Javascript Array 方法整理

    Javascript Array 方法整理 Javascript 数组相关方法 说明 大多数其它编程语言不允许改变数组大小,越界访问索引会报错,但是 javascript不会报错,不过不建议直接修改a ...

随机推荐

  1. Java,你告诉我 fail-fast 是什么鬼?

    本篇我们来聊聊 Java 的 fail-fast 机制,文字一如既往的有趣哦. 01.前言 说起来真特么惭愧:十年 IT 老兵,Java 菜鸟一枚.今天我才了解到 Java 还有 fail-fast ...

  2. 让块元素在div中水平居中,并且垂直居中的五种方法

    在写代码前,先做下准备工作,写两个div,设置下div的大小,把小的div放在大的div里面.可以给小的div设置下颜色,方便观看. 方法一:写一个伪元素,将它设置为行内块元素,高度与父元素相同,写一 ...

  3. python_day03

    今日所学内容 1.函数部分: #函数的三种定义方式#1.无参函数:不需要外部传入的参数#2.有参函数:需要接受外部传入的参数#3.空函数:def func(): pass#pass代表说明都不用做# ...

  4. 【并发编程】Java对并发编程的支持历史

    本博客系列是学习并发编程过程中的记录总结.由于文章比较多,写的时间也比较散,所以我整理了个目录贴(传送门),方便查阅. 并发编程系列博客传送门 本文转载,原文请点击链接 本章主要对Java并发(Con ...

  5. Linux 命令记录

    记录Linux下使用过的命令: Linux端 1.测试当前系统支持语言(我这用的是xshell,如果出现乱码,则在file-properties-terminal-encoding中,设置为utf-8 ...

  6. ggforce|绘制区域轮廓-区域放大-寻找你的“onepiece”

    首发于“生信补给站” https://mp.weixin.qq.com/s/fm69bw-3cww1YEW_kBcTHQ 更多关于R语言,ggplot2绘图,生信分析的内容,关注有惊喜

  7. 闲来无事写了一套 Jenkins 主题样式:刀锋

    背景 Jenkins 的前端 CSS 样式坚挺了这么多年已经觉得腻的不行了,于是想换个风格缓解一下视觉疲劳,便有了这个项目.由于本人不是前端,所以很多只是随便改改,有些复杂的需求也实现不了,但是总的来 ...

  8. SpringMVC配置了拦截器(interceptors)却显示不出css、js样式的解决办法

    首先因为在web.xml里面配置了 <filter-mapping> <filter-name>characterEncodingFilter</filter-name& ...

  9. Hbase初识

    简介 数据模型 相关数据库 典型应用 优势 劣势 key-value Redis 缓存 快速查询 存储数据缺乏结构化 列族 Cassandra,Hbase 分布式的文件系统,大规模的数据存储 易于分布 ...

  10. 《软件安装》centos 安装 mysql

    上期问题回顾 全球 IPv4 地址正式耗尽,IPv4地址大约42.9亿,按照理论来说,每一个联网的设备都需要IP地址,而现在全球联网设备远远不止42.9亿,那么,这么多设备是怎么处理联网的问题呢? 先 ...