简介

Selenium是广泛使用的模拟浏览器运行的库，它是一个用于Web应用程序测试的工具。 Selenium测试直接运行在浏览器中，就像真正的用户在操作一样，并且支持大多数现代 Web 浏览器。

函数介绍



重点方法

1.find_element方法是 Selenium WebDriver 提供的一种用于查找页面上某个符合条件的元素的方法。

2.find_elements 方法是 Selenium WebDriver 提供的一种用于查找页面上所有符合条件的元素的方法。与 find_element 不同，find_elements 返回的是一个列表，其中包含所有匹配的元素。如果没有找到任何元素，则返回一个空列表。

以下是 find_element(s) 方法的一些常见用法：

By.ID：通过元素的 ID 查找。

By.NAME：通过元素的 name 属性查找。

By.CLASS_NAME：通过元素的类名查找。

By.TAG_NAME：通过元素的标签名查找。

By.LINK_TEXT：通过链接文本查找。

By.PARTIAL_LINK_TEXT：通过部分链接文本查找。

By.CSS_SELECTOR：通过 CSS 选择器查找。

By.XPATH：通过 XPath 表达式查找。

driver.find_element对象具有.click()方法，就是点击这个元素

3.driver.window_handles获取当前所有窗口句柄

4.driver.switch_to.window()跳转到某个窗口

练习代码

from selenium import webdriver

from selenium.webdriver.common.by import By

import time

# 初始化浏览器驱动

driver = webdriver.Chrome()

# 打开阿里云漏洞库首页

driver.get("https://avd.aliyun.com/")

time.sleep(2)

# 定位输入框并输入关键字

search_box = driver.find_element(By.XPATH, "/html/body/header/nav/div/form/input")

search_box.send_keys("MySQL")

# 点击搜索按钮

search_button = driver.find_element(By.XPATH, '/html/body/header/nav/div/form/button')

search_button.click()

# 等待2秒

time.sleep(2)

res_header=driver.find_element(By.ID,'itl-header')

print(res_header.text)

tr_elements = driver.find_elements(By.XPATH,"/html/body/main/div[2]/div/div[2]/table/tbody")

for tr in tr_elements:

    # 在这里对每个tr元素进行操作，例如提取文本内容

    print(tr.text)

link = driver.find_element(By.PARTIAL_LINK_TEXT, "AVD-2024-21177")

link.click()

all_windows = driver.window_handles

driver.switch_to.window(all_windows[-1])

searchclass=driver.find_elements(By.CSS_SELECTOR, '.border-bottom.border-gray.pb-2.mb-0')

for search in searchclass:

    print(search.text)

time.sleep(3)

driver.close()

driver.switch_to.window(all_windows[0])# 切回原来的窗口

input("Press Enter to close the browser...")

# 关闭浏览器

driver.quit()

运行效果

运行过程

运行后先是打开浏览器进入阿里云漏洞库，紧接着搜索MYSQL相关漏洞，结果如下

通过html的id属性找到“搜索结果关于[mysql]的搜索数据”这几个字打印出来

tr_elements = driver.find_elements(By.XPATH,"/html/body/main/div[2]/div/div[2]/table/tbody")

res_header=driver.find_element(By.ID,'itl-header')

print(res_header.text)

通过xpath找到tbody里面所有行，遍历并打印内容

tr_elements = driver.find_elements(By.XPATH,"/html/body/main/div[2]/div/div[2]/table/tbody")

for tr in tr_elements:

    # 在这里对每个tr元素进行操作，例如提取文本内容

    print(tr.text)

随便定位一个漏洞介绍的链接点进去：

link = driver.find_element(By.PARTIAL_LINK_TEXT, "AVD-2024-21177")

link.click()

all_windows = driver.window_handles  # 获取所有窗口的句柄

driver.switch_to.window(all_windows[-1])#有的浏览器并不会自动跳转到点开的标签页，所以可以获取当前所有标签页再利用函数跳转

打印所有class="border-bottom border-gray pb-2 mb-0"的元素

searchclass=driver.find_elements(By.CSS_SELECTOR, '.border-bottom.border-gray.pb-2.mb-0')

for search in searchclass:

    print(search.text)

因为class的值包含空格所以不能直接By.CLASS寻找，用By.CSS_SELECTOR，每个值用点号分隔

关闭浏览器

selenium爬虫学习1的更多相关文章

python爬虫学习笔记（一）——环境配置（windows系统）
在进行python爬虫学习前,需要进行如下准备工作: python3+pip官方配置 1.Anaconda(推荐,包括python和相关库) [推荐地址:清华镜像] https://mirrors ...
python爬虫学习(1) —— 从urllib说起
0. 前言如果你从来没有接触过爬虫,刚开始的时候可能会有些许吃力因为我不会从头到尾把所有知识点都说一遍,很多文章主要是记录我自己写的一些爬虫所以建议先学习一下cuiqingcai大神的 Pyth ...
python爬虫学习 —— 总目录
开篇作为一个C党,接触python之后学习了爬虫. 和AC算法题的快感类似,从网络上爬取各种数据也很有意思. 准备写一系列文章,整理一下学习历程,也给后来者提供一点便利. 我是目录听说你叫爬虫 - ...
Selenium Grid 学习笔记
Selenium Grid 学习笔记http://www.docin.com/p-765680298.html
Selenium webdriver 学习总结-元素定位
Selenium webdriver 学习总结-元素定位 webdriver提供了丰富的API,有多种定位策略:id,name,css选择器,xpath等,其中css选择器定位元素效率相比xpath要 ...
爬虫学习之基于Scrapy的爬虫自动登录
###概述在前面两篇(爬虫学习之基于Scrapy的网络爬虫和爬虫学习之简单的网络爬虫)文章中我们通过两个实际的案例,采用不同的方式进行了内容提取.我们对网络爬虫有了一个比较初级的认识,只要发起请求获 ...
爬虫学习之基于Scrapy的网络爬虫
###概述在上一篇文章<爬虫学习之一个简单的网络爬虫>中我们对爬虫的概念有了一个初步的认识,并且通过Python的一些第三方库很方便的提取了我们想要的内容,但是通常面对工作当作复杂的需求 ...
Python爬虫学习：三、爬虫的基本操作流程
本文是博主原创随笔,转载时请注明出处Maple2cat|Python爬虫学习:三.爬虫的基本操作与流程一般我们使用Python爬虫都是希望实现一套完整的功能,如下: 1.爬虫目标数据.信息: 2.将 ...
Python爬虫学习：四、headers和data的获取
之前在学习爬虫时,偶尔会遇到一些问题是有些网站需要登录后才能爬取内容,有的网站会识别是否是由浏览器发出的请求. 一.headers的获取就以博客园的首页为例:http://www.cnblogs.c ...
Python爬虫学习：二、爬虫的初步尝试
我使用的编辑器是IDLE,版本为Python2.7.11,Windows平台. 本文是博主原创随笔,转载时请注明出处Maple2cat|Python爬虫学习:二.爬虫的初步尝试 1.尝试抓取指定网页 ...

随机推荐

从零开始的Python世界生活——语法基础先导篇（Python小白零基础光速入门上手）
从零开始的Python世界生活--语法基础先导篇(Python小白零基础光速入门上手) 1. 准备阶段 1.1 下载并安装Python 1.1.1 下载步骤: 访问Python官方网站:点击这里下载P ...
JavaScript之Object.defineProperty()
1. 对象的定义与赋值经常使用的定义与赋值方法obj.prop =value或者obj['prop']=value let Person = {}; Person.name = "Jack ...
Swagger UI、RESTful简介
Swagger UI 简介 Swagger UI允许任何人(无论您是开发团队还是最终用户)都可以可视化API资源并与之交互,而无需任何实现逻辑.它是根据您的OpenAPI(以前称为Swagger)规范 ...
获取不同型号手机小程序导航栏的高度（uniapp）
uni.getSystemInfo({ success: function(e) { Vue.prototype.StatusBar = e.statusBarHeight; let custom = ...
第七章 LinkedBlockingQueue源码解析
1.对于LinkedBlockingQueue需要掌握以下几点创建入队(添加元素) 出队(删除元素) 2.创建 Node节点内部类与LinkedBlockingQueue的一些属性 static ...
runoob-scala
https://www.runoob.com/scala/scala-tutorial.html Scala 简介 Scala 是一门多范式(multi-paradigm)的编程语言,设计初衷是要集成 ...
streamlit使用技巧
实现上传PDF并显示 ## 上传并预览(1M以内才可预览) def upload_Pre(): file = st.file_uploader("选择待上传的PDF文件", typ ...
Java实现LDAP登录
LDAP的全称是Lightweight Directory Access Protocol(轻量级目录访问协议),是一种用于访问和管理分布式目录信息服务的应用协议.LDAP通常用于存储用户.组和其他组 ...
HashMap的put方法的扩容流程
final Node<K,V>[] resize() { // [1,2,3,4,5,6,7,8,9,10,11,,,,] Node<K,V>[] oldTab = table ...
Docker核心技术及架构

selenium爬虫学习1