利用python监控CNNVD上面的新出漏洞实例，可以配合邮箱推送获取最新的漏洞情报

爬取cnnvd

import requests

from bs4 import BeautifulSoup

import re

import time

import csv

k = int(input("第几页结束"))

for n in range(1, k + 1):

   # n = int(input("第几页"))

   url = f"http://www.cnnvd.org.cn/web/cnnvdpatch/querylist.tag?pageno={n}"  # 访问这个网址拿取源码

   url_1 = "http://www.cnnvd.org.cn/"

   head = {

      "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/103.0.5060.53 Safari/537.36 Edg/103.0.1264.37"

   }

   data = requests.get(url, headers=head)

   # print(data.text)

   bs = BeautifulSoup(data.text, "html.parser")

   # print(bs)

   positioning = bs.find("div", class_="list_list").find_all("a")  # 找到特殊位置进行筛选 不能_class 只可以class_

   obj = re.compile(r'meta name="title" content="(?P<name>.*?)"', re.S)  # 使用re.S参数以后，正则表达式会将这个字符串作为一个整体，在整体中进行匹配

   # print(positioning)

   obj_2 = re.compile(r'</a><p><span>(?P<time>.*?).*?</span>(?P<time_1>.*?)</p>', re.S)  # 匹配时间的正则

   f = open("bugku.csv", "a+", encoding="utf-8")

   csv_writer = csv.writer(f)

   if n == 1:

      csv_writer.writerow(["漏洞名字", "修复措施", "发布时间"])

   else:

      pass

   for a in positioning:

      # print(a.get("href"))  # BeautifulSoup可以通过get直接拿到href里面的链接

      wangye = url_1 + a.get("href").strip("/")  # 拼接新链接

      req = requests.get(wangye)  # 通过get访问新链接

      # print(req.text)

      names = obj.findall(req.text)

      times = obj_2.finditer(req.text)  # 在req里面匹配时间整成元组

      for b in times:

         nams = names[-1]  # 漏洞名字

         uul = wangye  # 修复网页

         timetime = b.group("time") + b.group("time_1")  # 时间

         print(nams, uul, timetime)

         csv_writer.writerow([nams, uul, timetime])

   time.sleep(2)

   f.close()

   print("休息15秒")

   time.sleep(15)

Python爬取cnnvd的更多相关文章

Python 爬取所有51VOA网站的Learn a words文本及mp3音频
Python 爬取所有51VOA网站的Learn a words文本及mp3音频 #!/usr/bin/env python # -*- coding: utf-8 -*- #Python 爬取所有5 ...
python爬取网站数据
开学前接了一个任务,内容是从网上爬取特定属性的数据.正好之前学了python,练练手. 编码问题因为涉及到中文,所以必然地涉及到了编码的问题,这一次借这个机会算是彻底搞清楚了. 问题要从文字的编码讲 ...
python爬取某个网页的图片-如百度贴吧
python爬取某个网页的图片-如百度贴吧作者:vpoet mail:vpoet_sir@163.com 注:随意copy,不用告诉我 #coding:utf-8 import urllib imp ...
Python:爬取乌云厂商列表，使用BeautifulSoup解析
在SSS论坛看到有人写的Python爬取乌云厂商,想练一下手,就照着重新写了一遍原帖:http://bbs.sssie.com/thread-965-1-1.html #coding:utf- im ...
使用python爬取MedSci上的期刊信息
使用python爬取medsci上的期刊信息,通过设定条件,然后获取相应的期刊的的影响因子排名,期刊名称,英文全称和影响因子.主要过程如下: 首先,通过分析网站http://www.medsci.cn ...
python爬取免费优质IP归属地查询接口
python爬取免费优质IP归属地查询接口具体不表,我今天要做的工作就是: 需要将数据库中大量ip查询出起归属地刚开始感觉好简单啊,毕竟只需要从百度找个免费接口然后来个python脚本跑一晚上就o ...
Python爬取豆瓣指定书籍的短评
Python爬取豆瓣指定书籍的短评 #!/usr/bin/python # coding=utf-8 import re import sys import time import random im ...
python爬取网页的通用代码框架
python爬取网页的通用代码框架: def getHTMLText(url):#参数code缺省值为‘utf-8’(编码方式) try: r=requests.get(url,timeout=30) ...
没有内涵段子可以刷了，利用Python爬取段友之家贴吧图片和小视频(含源码)
由于最新的视频整顿风波,内涵段子APP被迫关闭,广大段友无家可归,但是最近发现了一个"段友"的app,版本更新也挺快,正在号召广大段友回家,如下图,有兴趣的可以下载看看(ps:我不 ...
python 爬取历史天气
python 爬取历史天气官网:http://lishi.tianqi.com/luozhuangqu/201802.html # encoding:utf-8 import requests fr ...

随机推荐

Eureka Server 实现在线扩容
Eureka Server 实现在线扩容作者:Grey 原文地址: 博客园:Eureka Server 实现在线扩容 CSDN:Eureka Server 实现在线扩容需求 Eureka 是 Sp ...
C#中ref和out关键字的应用以及区别（参数修饰符）
ref ref的定义 ref是reference的缩写,通过引用来传递参数的地址,ref基本上是服务于值类型的 ref的使用 //不使用 ref; void Method(int myRefInt) ...
三十四、kubernetes证书介绍
Kubernetes 证书介绍一.证书机制说明 Kubernetes 作为一个分布式集群的管理工具,保证集群的安全性是其一个重要的任务.API Server 是集群内部各个组件通信的中介,也是外部控 ...
k8s挂在问题
今天在重启pod这个后发现一直处于然后去describe发现报错如下先去手动mount的发现挂在不了然后去slave节点发现这个没有安装然后手动去安装后重启pod问题解决
云原生之旅 - 5）Kubernetes时代的包管理工具 Helm
前言上一篇文章 [基础设施即代码使用 Terraform 创建 Kubernetes] 教会了你如何在Cloud上面建Kubernetes资源,那么本篇来讲一下如何在Kubernetes上面部署应 ...
手把手教你使用LabVIEW实现Mask R-CNN图像实例分割
前言前面给大家介绍了使用LabVIEW工具包实现图像分类,目标检测,今天我们来看一下如何使用LabVIEW实现Mask R-CNN图像实例分割. 一.什么是图像实例分割? 图像实例分割(Instan ...
Unreal NetMode&NetRole 解析
Version: Unreal 4.26 问题为啥UE编辑器会有EPlayNetMode有三种让你选择. 为啥描述World 的ENetMode 会有4种,而不只是(Client/Server 2种 ...
C++一个吃豆人小游戏
C++一个吃豆人小游戏代码如下 #include <cstdio>#include <iostream>#include <ctime>#include < ...
获取联通光猫PT952G的管理员密码
前言普通用户的帐号和密码在光猫的背面输入光猫网关即可跳转到登录界面但是没有什么权限操作东西,所以我找到了管理员界面输入网关+cu.html 即可跳转到管理员界面例如我这里是http://1 ...
hashlib加密 logging日志 subprocess
Day23 hashlib加密 logging日志 hahlib加密模块 logging日志模块 subprocess模块 1.hahlib加密模块 1.什么是加密? 将明文数据处理成密文数据的过程 ...

Python爬取cnnvd

爬取cnnvd

Python爬取cnnvd的更多相关文章

随机推荐

热门专题