利用python监控CNNVD上面的新出漏洞实例，可以配合邮箱推送获取最新的漏洞情报

爬取cnnvd

import requests

from bs4 import BeautifulSoup

import re

import time

import csv

k = int(input("第几页结束"))

for n in range(1, k + 1):

   # n = int(input("第几页"))

   url = f"http://www.cnnvd.org.cn/web/cnnvdpatch/querylist.tag?pageno={n}"  # 访问这个网址拿取源码

   url_1 = "http://www.cnnvd.org.cn/"

   head = {

      "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/103.0.5060.53 Safari/537.36 Edg/103.0.1264.37"

   }

   data = requests.get(url, headers=head)

   # print(data.text)

   bs = BeautifulSoup(data.text, "html.parser")

   # print(bs)

   positioning = bs.find("div", class_="list_list").find_all("a")  # 找到特殊位置进行筛选 不能_class 只可以class_

   obj = re.compile(r'meta name="title" content="(?P<name>.*?)"', re.S)  # 使用re.S参数以后，正则表达式会将这个字符串作为一个整体，在整体中进行匹配

   # print(positioning)

   obj_2 = re.compile(r'</a><p><span>(?P<time>.*?).*?</span>(?P<time_1>.*?)</p>', re.S)  # 匹配时间的正则

   f = open("bugku.csv", "a+", encoding="utf-8")

   csv_writer = csv.writer(f)

   if n == 1:

      csv_writer.writerow(["漏洞名字", "修复措施", "发布时间"])

   else:

      pass

   for a in positioning:

      # print(a.get("href"))  # BeautifulSoup可以通过get直接拿到href里面的链接

      wangye = url_1 + a.get("href").strip("/")  # 拼接新链接

      req = requests.get(wangye)  # 通过get访问新链接

      # print(req.text)

      names = obj.findall(req.text)

      times = obj_2.finditer(req.text)  # 在req里面匹配时间整成元组

      for b in times:

         nams = names[-1]  # 漏洞名字

         uul = wangye  # 修复网页

         timetime = b.group("time") + b.group("time_1")  # 时间

         print(nams, uul, timetime)

         csv_writer.writerow([nams, uul, timetime])

   time.sleep(2)

   f.close()

   print("休息15秒")

   time.sleep(15)

Python爬取cnnvd的更多相关文章

Python 爬取所有51VOA网站的Learn a words文本及mp3音频
Python 爬取所有51VOA网站的Learn a words文本及mp3音频 #!/usr/bin/env python # -*- coding: utf-8 -*- #Python 爬取所有5 ...
python爬取网站数据
开学前接了一个任务,内容是从网上爬取特定属性的数据.正好之前学了python,练练手. 编码问题因为涉及到中文,所以必然地涉及到了编码的问题,这一次借这个机会算是彻底搞清楚了. 问题要从文字的编码讲 ...
python爬取某个网页的图片-如百度贴吧
python爬取某个网页的图片-如百度贴吧作者:vpoet mail:vpoet_sir@163.com 注:随意copy,不用告诉我 #coding:utf-8 import urllib imp ...
Python:爬取乌云厂商列表，使用BeautifulSoup解析
在SSS论坛看到有人写的Python爬取乌云厂商,想练一下手,就照着重新写了一遍原帖:http://bbs.sssie.com/thread-965-1-1.html #coding:utf- im ...
使用python爬取MedSci上的期刊信息
使用python爬取medsci上的期刊信息,通过设定条件,然后获取相应的期刊的的影响因子排名,期刊名称,英文全称和影响因子.主要过程如下: 首先,通过分析网站http://www.medsci.cn ...
python爬取免费优质IP归属地查询接口
python爬取免费优质IP归属地查询接口具体不表,我今天要做的工作就是: 需要将数据库中大量ip查询出起归属地刚开始感觉好简单啊,毕竟只需要从百度找个免费接口然后来个python脚本跑一晚上就o ...
Python爬取豆瓣指定书籍的短评
Python爬取豆瓣指定书籍的短评 #!/usr/bin/python # coding=utf-8 import re import sys import time import random im ...
python爬取网页的通用代码框架
python爬取网页的通用代码框架: def getHTMLText(url):#参数code缺省值为‘utf-8’(编码方式) try: r=requests.get(url,timeout=30) ...
没有内涵段子可以刷了，利用Python爬取段友之家贴吧图片和小视频(含源码)
由于最新的视频整顿风波,内涵段子APP被迫关闭,广大段友无家可归,但是最近发现了一个"段友"的app,版本更新也挺快,正在号召广大段友回家,如下图,有兴趣的可以下载看看(ps:我不 ...
python 爬取历史天气
python 爬取历史天气官网:http://lishi.tianqi.com/luozhuangqu/201802.html # encoding:utf-8 import requests fr ...

随机推荐

JK触发器与模12计数器
JK触发器 JK触发器具有保持,置0,置1和翻转四个功能. 则可得出次态方程:\(Q_{n+1} = JQ_n'+K'Q_n\) Design `timescale 1ns / 1ps module ...
JavaScript for循环的终止问题
js的for循环,return,break,continue的使用方式和解释 let funcFor = () => { for (let i = 0; i < 4; i++) { if ...
[zoj] 4178. Killing the Brute-force
题目 Chenjb is the task author of the 71-st Zhejiang Provincial Collegiate Programming Contest. He cre ...
Java新特性（2）：Java 10以后
您好,我是湘王,这是我的博客园,欢迎您来,欢迎您再来- 虽然到目前为止Java的版本更新还没有什么惊天动地的改变,但总是会冒出一些有趣的小玩意.前面列举了Java9和Java10的一些特色,现在接着来 ...
[排序算法] 简单选择排序 (C++)
简单选择排序原理简单选择排序 SelectSort 是一种十分直观地排序方法.其原理是每次从未排序的元素中找到当前最小的元素,放在当前未排序序列的首位.一直重复操作直至最后未排序的元素个数为 0,即 ...
linux开机进入grub rescue界面修复
一.先输入ls回车,查看显示内容如: (hd0) (hd0,msdos1) (hd0,msdos2)... 二.然后找出哪个盘安装了系统 ls (hd0,msdos1)/boot/grub/ ls( ...
【SQL基础】基础查询：所有列、指定列、去重、限制行数、改名
〇.建表数据 drop table if exists user_profile; CREATE TABLE `user_profile` ( `id` int NOT NULL, `device_i ...
填坑日志-云网络智慧课堂双网卡Mac地址读取错误的问题及解决
云网络智慧课堂的双网卡问题记录及解决方案教师端其实这里双网卡的问题一直没有解决,分为了两部分,一部分是教师端,一部分是学生端.症状类似,问题也类似,都是在设计之初因为硬件限制可能没有考虑到双网卡的 ...
多表查询两种方法、可视化软件navicat、python操作mysql、pymysql模块
目录多表查询的思路多表查询的两种方法小知识点补充数说明可视化软件Navicat 安装教程数据库常用操作多表查询练习题 python 操作MySQL pymysql补充说明 Non-grou ...
md5-有道翻译
网站 aHR0cHMlM0EvL2ZhbnlpLnlvdWRhby5jb20v 测试发现三个值是变化的一.第一种方法 initiator一步一步找,在t.translate中找到以下内容这里可以看 ...

Python爬取cnnvd

爬取cnnvd

Python爬取cnnvd的更多相关文章

随机推荐

热门专题