封装读取方法：

import xlrd

from selenium import webdriver

from selenium.webdriver.common.by import By

class rdExcel():

    def __init__(self,excel_dir,sheet_name):

        self.r = []

        self.rd = xlrd.open_workbook(excel_dir)

        self.sh = self.rd.sheet_by_name(sheet_name)

        #首行设置为key

        self.key = self.sh.row_values(0)

        #获取总行数

        self.rownum = self.sh.nrows

        #获取总列数

        self.colnum = self.sh.ncols

    def function(self):

        if self.rownum<=1:

            print("没有获取到数值")

        else:

            r = []

            j=1

            #要执行的行数

            for i in range(self.rownum - 1):

                s = {}

                values = self.sh.row_values(j)

                for x in range(self.colnum):

                    s[self.key[x]] = values[x]

                r.append(s)

                j+=1

            # print(r)

            return r

if __name__ == '__main__':

    a = input("excel_dir:")

    b = input("sheet_name:")

    data = rdExcel(a,b)

    print(data.function())

基本操作：指定单元格读取数据

rd = xlrd.open_workbook("C:\\Users\\ZHANGCH\\Desktop\\test99.xlsx")

sh = rd.sheet_by_name("rdData")

value = sh.row_values(1)[0]

driver = webdriver.Chrome()

driver.maximize_window()

driver.get("http://www.baidu.com")

driver.find_element(By.CSS_SELECTOR,"#kw").send_keys(value)

driver.find_element(By.CSS_SELECTOR,"#su").click()

============================================================================

写法进行修改规整，完整获取指定数据进行百度查询：

写法①：

import xlrd

import os

from selenium import webdriver

from selenium.webdriver.common.by import By

from time import sleep

base = os.path.dirname(os.path.dirname(__file__))

base_dir = base.replace('/','\\')

file_dir = base_dir + os.sep + "test" + os.sep + "test99.xlsx"

print(file_dir)

class test():

    def __init__(self,file_dir,sheet_name):

        self.rd = xlrd.open_workbook(file_dir)

        self.sh = self.rd.sheet_by_name(sheet_name)

        self.rows = self.sh.nrows

        self.cols = self.sh.ncols

    def ExcelRd(self):

        r = []

        for i in range(1,self.rows):

            values = self.sh.row_values(i,0,self.cols)

            r.append(values)

        return r

if __name__ == '__main__':

    #指定sheet页为：rdData

    file_dir = input("路径为：")

    sheet_name = input("sheet页为：")

    data = test(file_dir,sheet_name).ExcelRd()

    driver = webdriver.Chrome()

    driver.maximize_window()

    driver.implicitly_wait(10)

    driver.get("https://www.baidu.com")

    for footballStar in data:

        driver.find_element(By.CSS_SELECTOR,"#kw").clear()

        driver.find_element(By.CSS_SELECTOR,"#kw").send_keys(footballStar[1])

        driver.find_element(By.CSS_SELECTOR,"#su").click()

        sleep(5)

    driver.quit()

写法②：添加截图方法

function.py：

import os

def screenshot(driver,img_name):

    base = os.path.dirname(os.path.dirname(__file__))

    base_dir = base.replace("/","\\")

    img_dir = base_dir + os.sep + "20180515作业" + os.sep + "image" + os.sep + img_name + ".png"

    driver.get_screenshot_as_file(img_dir)

Excel读取数据.py：

import xlrd

import os

from selenium import webdriver

from selenium.webdriver.common.by import By

from time import sleep

from function import screenshot

class test(object):

    def __init__(self):

        self.base = os.path.dirname(os.path.dirname(__file__))

        self.base_dir = self.base.replace('/', '\\')

    def ExcelRd(self):

        file_dir = self.base_dir + os.sep + "20180515作业" + os.sep + "test_xlsx.xlsx"

        rd = xlrd.open_workbook(file_dir)

        sh = rd.sheet_by_name("rdData")

        rows = sh.nrows

        cols = sh.ncols

        r = []

        for i in range(1,rows):

            values = sh.row_values(i,0,cols)

            r.append(values)

        return r

if __name__ == '__main__':

    data = test().ExcelRd()

    driver = webdriver.Chrome()

    driver.maximize_window()

    driver.implicitly_wait(10)

    driver.get("https://www.baidu.com")

    for footballStar in data:

        fbStar = footballStar[1]

        driver.find_element(By.CSS_SELECTOR,"#kw").clear()

        driver.find_element(By.CSS_SELECTOR,"#kw").send_keys(fbStar)

        driver.find_element(By.CSS_SELECTOR,"#su").click()

        sleep(3)

        fbStar_xlsx = str("xlsx_" + fbStar)

        screenshot(driver,fbStar_xlsx)

        sleep(7)

    driver.quit()

二、从CSV读取数据进行百度搜索

CSV读取数据.py：

import csv

import os

from selenium import webdriver

from selenium.webdriver.common.by import By

from time import sleep

from function import screenshot

class test(object):

    def __init__(self):

        base = os.path.dirname(os.path.dirname(__file__))

        self.base_dir = base.replace("/","\\")

    def CSVRd(self):

        base_dir = self.base_dir + os.sep + "20180515作业" + os.sep + "test_csv.csv"

        opFile = open(base_dir,'r')

        rd = csv.reader(opFile)

        r = []

        next(rd,None)

        for i in rd:

            r.append(i)

        return r

if __name__ == '__main__':

    data = test().CSVRd()

    driver = webdriver.Chrome()

    driver.maximize_window()

    driver.get("https://www.baidu.com")

    driver.implicitly_wait(10)

    for fbStar in data:

        fbStar = fbStar[1]

        driver.find_element(By.CSS_SELECTOR,"#kw").clear()

        driver.find_element(By.CSS_SELECTOR,"#kw").send_keys(fbStar)

        driver.find_element(By.CSS_SELECTOR,"#su").click()

        sleep(3)

        csv_fbStar = str("csv_" + fbStar)

        screenshot(driver,csv_fbStar)

        sleep(7)

    driver.quit()

三、从XML读取数据进行登录操作

test_xml文件：

<?xml version="1.0" encoding="utf-8"?>

<info>

    <title>博客园登录</title>

    <url_dir>https://passport.cnblogs.com/user/signin</url_dir>

    <login username="owen_name" password="owen_pwd">登录</login>

</info>

CSV读取数据.py：

import xml.dom.minidom as minidom

# import xml.etree.ElementTree as ele

import os

from selenium import webdriver

from selenium.webdriver.common.by import By

from time import sleep

from function import screenshot

base = os.path.dirname(os.path.dirname(__file__))

base_dir = base.replace("/","\\")

file_dir = base_dir + os.sep + "20180515作业" + os.sep + "test_xml.xml"

#打开xml文档

dom = minidom.parse(file_dir)

#得到文档元素

root = dom.documentElement

#由于下面getElementsByTagName点不出来方法，手写的

tag1 = root.getElementsByTagName("login")

tag2 = root.getElementsByTagName("url_dir")

tag3 = root.getElementsByTagName("title")

#获得标签属性值

username = tag1[0].getAttribute("username")

password = tag1[0].getAttribute("password")

#获得标签之间的数据

url = tag2[0].firstChild.data

title = tag3[0].firstChild.data

driver = webdriver.Chrome()

driver.maximize_window()

driver.get(url)

driver.find_element(By.CSS_SELECTOR,"#input1").clear()

driver.find_element(By.CSS_SELECTOR,"#input1").send_keys(username)

sleep(3)

driver.find_element(By.CSS_SELECTOR,"#input2").clear()

driver.find_element(By.CSS_SELECTOR,"#input2").send_keys(password)

sleep(3)

title = str("xml_" + title)

screenshot(driver,title)

driver.quit()

四、附：学习资料

《Python不归路_xml.etree.ElementTree模块》感谢作者：深海一尾鱼

《python读取xml文件》感谢作者：虫师

【Selenium + Python】之 Excel、CSV、XML文件读取数据并运用数据百度查询的更多相关文章

python解析VOC的xml文件并转成自己需要的txt格式
在进行神经网络训练的时候,自己标注的数据集往往会有数据量不够大以及代表性不强等问题,因此我们会采用开源数据集作为训练,开源数据集往往具有特定的格式,如果我们想将开源数据集为我们所用的话,就需要对其格式 ...
php xml 文件读取 XMLReader
php xml 文件读取 <?php /** $xmlString = '<xml> <persons count="10"> <person ...
javascript读取xml文件读取节点数据的例子
分享下用javascript读取xml文件读取节点数据方法. 读取的节点数据,还有一种情况是读取节点属性数据. <head> <title></title> < ...
xml文件读取到数据库
xml文件读取到数据库第一步,导包 c3p0,dom4j,jaxen,MySQL-connector 第二步 xml文件,config文件第三步 javabean 第四步 c3p0的工具类 ...
C#程序中：如何修改xml文件中的节点（数据）
要想在web等程序中实现动态的数据内容给新(如网页中的Flash),不会更新xml文件中的节点(数据)是远远不够的,今天在这里说一个简单的xml文件的更新,方法比较基础,很适合初学者看的,保证一看就懂 ...
Excel和XML文件导入
using System;using System.Collections;using System.Collections.Generic;using System.Configuration;us ...
XML文件读取工具类
/// <summary> /// Author: jiangxiaoqiang /// </summary> public class XmlReader { //===== ...
Excel关联xml文件
1.新建没传值的xml文件,变量名称自己定义好 2.打开excel,如果之前没有设置过,点击选项如果当前Excel菜单栏中没有开发工具项,在自定义功能区先勾选上开发选项 3.点右下角的xml映射弹 ...
Xml 文件读取
.NET 读取Xml文件,用到XmlDocument类. 1.要获取文档的根: DocumentElement. 2.Attributes :获取 XmlAttributeCollection 包含此 ...

随机推荐

基于Bootstrap的对话框插件bootstrap-dialog
写在前面: bootstrap本身提供了它自己的模态框,但是感觉并不太友好,当需要在页面点击一个按钮打开一个窗口页面时,使用原有的bootstrap的模态框,会把所有的代码全部写在一个jsp页面,显得 ...
【NOIP模拟赛】【数学真奇妙】【递推】旅行者问题
旅行者问题 [问题描述] lahub是一个旅行者的粉丝,他想成为一个真正的旅行者,所以他计划开始一段旅行.lahub想去参观n个目的地(都在一条直道上).lahub在起点开始他的旅行.第i个目的地和起 ...
【转】MySQL5.5的my.cnf 参数详解
这篇文章很多地方只是翻译了my.cnf原始配置文件的说明以下原文中有些参数事实上不适用于MySQL5.5,不知道原作者是否有经过实际测试,比如log-slow-queries应该写成slow-que ...
ylb：事务
ylbtech_sqlserver create database bank go use bank go create table users ( uid ,), uname ) not null, ...
DTD 和 Schema简介
什么是DTD? DTD(文档类型定义)的作用是定义 XML 文档的合法构建模块. 它使用一系列的合法元素来定义文档结构. DTD例子 <?xml version="1.0"? ...
scp拷贝本地文件到服务器
拷贝远程服务器的文件到本地:scp -r -P 端口号用户名@IP地址:/usr/local/tomcat_airc/webapps/ /tmp/kyj/ 拷贝本地文件到远程服务 ...
2017.6.27 jdbc基本使用
参考来自:http://www.runoob.com/w3cnote/jdbc-use-guide.html 1.jdbc的执行流程 JDBC API 允许用户访问任何形式的表格数据,尤其是存储在关系 ...
[阿里Hao]Android无线开发的几种经常使用技术
本文由阿里巴巴移动安全client.YunOS资深project师Hao(嵌入式企鹅圈原创团队成员)撰写,是Hao在嵌入式企鹅圈发表的第一篇原创文章.对Android无线开发的几种经常使用技术进行综述 ...
系统重装 JUJUMAO VHD安装WIN7解析
1 把原有系统分区一个删除(使用第三方分区工具如PM或者PQ)并新建一个系统分区(也可以同时新建其他分区如D盘,E盘,但是一定要把C盘设置为NTFS格式并且活动的!) 2 将JUJUMAO_VHD ...
Django的Form、CSRF、cookie和session
Django是一个大而全的web框架,为我们提供了很多实用的功能,本文主要介绍Form.CSRF.cookie和session 一.Form 在web页面中form表单是重要的组成部分,为了数据安全和 ...

【Selenium + Python】之 Excel、CSV、XML文件读取数据并运用数据百度查询

封装读取方法：

基本操作：指定单元格读取数据

写法进行修改规整，完整获取指定数据进行百度查询：

【Selenium + Python】之 Excel、CSV、XML文件读取数据并运用数据百度查询的更多相关文章

随机推荐

热门专题