selenium,webdriver模仿浏览器访问百度基础1

这是一种比较好的反反爬技术

#安装：pip install selenium=2.48.0

#显示：pip show selenium

#卸载：pip uninstall selenium

#模拟用户行为

from selenium import webdriver

import os

import time

from selenium import common

#生成一个浏览器对象

driver = webdriver.PhantomJS()

#访问

driver.get('http://www.baidu.com/')

#创建文件夹存放数据

root_dir = 'baidu'

if not os.path.exists(root_dir):

    os.mkdir(root_dir)

#存储的文件夹及命名的文件名

file_name = root_dir + '/homepage.png'

#截屏并保存图片

driver.save_screenshot(file_name)

#模拟用户行为操作

timeout = 4

count = 0

#输入行为

while True:

    #只进行访问四次  访问不成功就终止

    if count > 4:

        break

    try:

        #通过id号找到百度的输入框

        obj = driver.find_element_by_id('kw')

        #在找到的输入框中 输入文字

        obj.send_keys(u'章丘铁锅')

        print(obj)

        break

    except common.exceptions.NoSuchElementException as e:

        print(e)

        #报错后 等待4秒 再次访问

        time.sleep(timeout)

        count += 1

#存储的文件夹及命名的文件名

file_name = root_dir + '/homepage_zhangqiutieguo.png'

#截屏并保存图片

driver.save_screenshot(file_name)

#模拟鼠标点击操作

#通过id号找到点击按钮

su = driver.find_element_by_id('su')

#点击

su.click()

#等到4秒 等页面加载完成

time.sleep(4)

#存储的文件夹及命名的文件名

file_name = root_dir + '/homepage_search.png'

#截屏并保存图片  运行后就可以看到 相当于在百度输入章丘铁锅后的页面  想想都很激动呢

driver.save_screenshot(file_name)

selenium,webdriver模仿浏览器访问百度基础1的更多相关文章

selenium,webdriver模仿浏览器访问百度基础2
学python理念 : 代码要多敲一定要多敲哪怕很基础注释要清晰由于基础1有一些注释写的很详细, 在这里有些注释没有写的很详细可以配合基础1一起学习哦 from selenium im ...
python selenium webdriver处理浏览器滚动条
用键盘右下角的UP,DOWN按键来处理页面滚动条这种方法很灵活用起来很方便!!!! from selenium import webdriver import time from selenium. ...
用webdriver模仿浏览器爬取豆瓣python书单
用webdriver模仿浏览器爬取豆瓣python书单其中运用到os 模块作用是生成文件夹存储爬取的信息 etree 用于xpath解析内容详细代码如下可用我的上一篇博客存取到excel当 ...
selenium WebDriver 对浏览器标签页的切换
关于selenium WebDriver 对浏览器标签页的切换,现在的市面上最新的浏览器,当点击一个链接打开一个新的页面都是在浏览器中打开一个标签页,而selenium只能对窗口进行切换的方法,只能操 ...
selenium webdriver(1)---浏览器操作
启动浏览器如何启动浏览器已在上篇文章中说明,这里还是以chrome为例,firefox.IE启动方式相同. //启动浏览器 import org.openqa.selenium.WebDriver; ...
Java环境下 selenium webDriver + chrome浏览器搭建与调试
一.首先下载selenium webDriver jar包,下载地址如下: http://selenium-release.storage.googleapis.com/index.html 二.下载 ...
基于Python, Selenium, Phantomjs无头浏览器访问页面
引言: 在自动化测试以及爬虫领域,无头浏览器的应用场景非常广泛,本文将梳理其中的若干概念和思路,并基于代码示例其中的若干使用技巧. 1. 无头浏览器通常大家在在打开网页的工具就是浏览器,通过界面上输 ...
使用python selenium webdriver模拟浏览器
selenium是进行web自动化测试的一个工具,支持C,C++,Python,Java等语言,他能够实现模拟手工操作浏览器,进行自动化,通过webdriver驱动浏览器操作,我使用的是chrome浏 ...
selenium webdriver处理浏览器Cookie
有时候我们需要验证浏览器中是否存在某个cookie,因为基于真实的cookie 的测试是无法通过白盒和集成测试完成的.WebDriver 提供了操作Cookie 的相关方法可以读取.添加和删除cook ...

随机推荐

Codeforces 1093C (思维+贪心)
题面传送门题目大意: 有一个长n(n为偶数)的序列a 已知a满足 \(a_1≤a_2≤⋯≤a_n\) 给出一个长度为\(\frac{n}{2}\) 的序列b,定义\(b_i=a_i+a_{n-i+ ...
Emacs中的前进后退jump-tree
Emacs中的前进后退jump-tree */--> code {color: #FF0000} pre.src {background-color: #002b36; color: #8394 ...
Linux服务器安全配置小结(转)
众所周知,网络安全是一个非常重要的课题,而服务器是网络安全中最关键的环节.Linux被认为是一个比较安全的Internet服务器,作为一种开放源代码操作系统,一旦Linux系统中发现有安全漏洞,Int ...
hdu3664 Permutation Counting（dp）
hdu3664 Permutation Counting 题目传送门题意: 在一个序列中,如果有k个数满足a[i]>i:那么这个序列的E值为k,问你在n的全排列中,有多少个排列是恰好是E值为 ...
JavaScript给动态插入的元素添加事件绑定
由于实际的需要,有时需要往网页中动态的插入HTML内容,并在插入的节点中绑定事件处理函数.我们知道,用Javascript向HTML文档中插入内容,有两种方法, 一种是在写HTML代码写入JS,然后 ...
html中内联元素和块级元素的区别
1.下表列出了内联元素和块级元素的主要区别 html中内联元素和块级元素的区别块级元素行内元素独占一行,默认情况下,其宽度自动填满其父元素宽度相邻的行内元素会排列在同一行里,直到一行排不下,才 ...
UIGestureRecognizer 手势
- (void)viewDidLoad { [super viewDidLoad]; // Do any additional setup after loading the view. self.v ...
Checklist: 2019 05.01 ~ 06.30
Golang Lessons learned porting 50k loc from Java to Go Five things that make Go fast Simple techniqu ...
html5 自制播放器
代码实例: <!DOCTYPE html> <html lang="en"> <head> <meta charset="UTF ...
Sublime Text 注册及使用相关
sublime text3 注册码 2019-07-01 注册码可以直接用地址: 2019-07-01 亲测可用 2019-07-18 亲测可用 -– BEGIN LICENSE -– Die So ...

selenium,webdriver模仿浏览器访问百度 基础1

selenium,webdriver模仿浏览器访问百度 基础1的更多相关文章

随机推荐

热门专题

selenium,webdriver模仿浏览器访问百度基础1

selenium,webdriver模仿浏览器访问百度基础1的更多相关文章