利用requests库访问360主页20次

一、安装

1、cmd进入命令行界面

2、直接输入 D:切换至D盘（python所在路径），

然后cd python下的scripts所在路径，切换至pip所在位置

3、pip install requests 即可安装requests

其中，pip版本过低时，使用：python -m pipinstall --upgrade pip升级pip版本

二、requests的使用

循环访问一个网页多次：

import requests

 

url = 'https://hao.360.cn//'

fout = open('result.txt', 'w')

for i in range(10):

    r=requests.post(url)

    fout.write(url+' ： OK withstatus_code: '+str(r.status_code))

    print(url+' ： OK withstatus_code: '+str(r.status_code))

fout.close()

爬取中国大学排行

import requests

from bs4 import BeautifulSoup

import bs4

from pandas import DataFrame

def getHTML(url):

    try:

        r = requests.get(url, timeout=30)

        r.raise_for_status()

        #解码格式

        r.encoding = r.apparent_encoding

        return r.text

    except:

        print("获取错误")

def moveToList(ulist, html):

    soup = BeautifulSoup(html, "html.parser")

    # print(soup.find('tbody').childern)

    # 找到目标数据标签，遍历tbody的孩子

    for tr in soup.find('tbody').children:

        # 过滤,如果tr的类型是bs4.element.Tag，那就是目标类型

        if isinstance(tr, bs4.element.Tag):

            # print(tr)

            #将所有td标签（列值）存储到列表中

            tds = tr('td')

            # 将每个列表添加到大列表中作为一个元素，只取前三列（排名，大学，省份）的string(内容)

            ulist.append([tds[0].string, tds[1].string, tds[2].string])

def printHTML(ulist,num):

    tplt="{0:^6}\t{1:{3}^10}\t{2:<10}"

    print(tplt.format("排名", "学校名称", "省份",chr(12288)))

    for i in range(num):

        u=ulist[i]

        print(tplt.format(u[0], u[1], u[2],chr(12288)))

    pass

def main():

    url = "http://www.zuihaodaxue.com/zuihaodaxuepaiming2018.html"

    html = getHTML(url)

    # print(html)

    uinfo = []

    moveToList(uinfo, html)

    frame=DataFrame(uinfo)

   #这里可以将内容输出到csv文件，data是项目下的包，修改相对路劲即可

    #frame.to_csv("../data/bestUniversity.csv",index=0)

    printHTML(uinfo,20)

main()

利用requests库访问360主页20次的更多相关文章

利用requests库访问网站
1.关于requests库函数 Response对象包含服务器返回的所有信息,也包含请求的Request信息. 访问百度二十次 import requests def getHTMLText(url ...
python脚本实例002－利用requests库实现应用登录
#! /usr/bin/python # coding:utf-8 #导入requests库 import requests #获取会话 s = requests.session() #创建登录数据 ...
python利用requests库模拟post请求时json的使用
我们都见识过requests库在静态网页的爬取上展现的威力,我们日常见得最多的为get和post请求,他们最大的区别在于安全性上: 1.GET是通过URL方式请求,可以直接看到,明文传输. 2.POS ...
爬虫入门实例：利用requests库爬取笔趣小说网
w3cschool上的来练练手,爬取笔趣看小说http://www.biqukan.com/, 爬取<凡人修仙传仙界篇>的所有章节 1.利用requests访问目标网址,使用了get方法 ...
利用Requests库写爬虫
基本Get请求: #-*- coding:utf-8 -*- import requests url = 'http://www.baidu.com' r = requests.get(url) pr ...
requests库写接口测试框架初学习
学习网址: https://docs.microsoft.com/en-us/openspecs/windows_protocols/ms-dscpm/ff75b907-415d-4220-89 ...
selenium原理应用 - 利用requests模拟selenium驱动浏览器
前言 selenium是一个web自动化测试的开源框架,它支持多语言:python/java/c#… 前面也有一篇文章说明了,selenium+浏览器的环境搭建. selenium支持多语言,是因为s ...
『居善地』接口测试 — 3、Requests库介绍
目录 1.Requests库 2.Requests库文档 3.Requests库安装 4.Requests库的使用 (1)使用步骤 (2)示例练习 5.补充:Json数据和Python对象互相转化 1 ...
requests库结合selenium库共同完成web自动化和爬虫工作
我们日常工作中,单纯的HTTP请求,程序员都倾向于使用万能的python Requests库.但大多数场景下,我们的需求页面不是纯静态网页,网页加载过程中伴随有大量的JS文件参与页面的整个渲染过程,且 ...

随机推荐

Hibernate的Hql语句使用in关键字
原文地址:https://blog.csdn.net/u013410747/article/details/50954867
NFS服务器安装测试
NFS为网络文件系统,允许网络中的计算机通过TCP/IP协议进行网络资源共享. 软件安装: $ sudo apt-get install nfs-kernel-server (1)服务器端 1)创建共 ...
day60——单表操作补充（批量插入、查询、表结构）
day60 批量插入(bulk_create) # bulk_create obj_list = [] for i in range(20): obj = models.Book( title=f'金 ...
11. Scala数据结构(下)-集合操作
11.1 集合元素的映射-map映射操作 11.1.1 看一个实际需求要求:请将List(3,5,8)中所有的元素都*2,将其结果放到一个新的集合中返回,即返回一个新的List(6,10,16),请 ...
SQL系列（九）—— 子查询（subQuery）
1.子查询前面的系列介绍的都是简单的查询场景,其中都只涉及到单张表的数据检索.但是在日常是实际应用中,数据模型之间的关系都非常的复杂,数据的需求一般都是来源于多个数据模型之间的组合而成,即对应多张表 ...
c#十进制转换
1.方法定义 /// <summary> /// 十进制转换 /// </summary> /// <param name="hexChar"> ...
C#完成使用异步线程定时更新窗体标签内容，并对标签内容进行求和显示
这是我在面试过程中遇到的一个小测试,很可惜,当天未能圆满完成,虽然第二天经过实际测试已经OK 了,但学无止境,继续努力吧,特将此代码贴在这里,供以后学习使用: namespace mytest { p ...
1.ZooKeeper ACL权限控制
参考:https://blog.csdn.net/liuxiao723846/article/details/79391650 ZK 类似文件系统,Client 可以在上面创建节点.更新节点.删除节点 ...
pandas-21 Series和Dataframe的画图方法
pandas-21 Series和Dataframe的画图方法 ### 前言在pandas中,无论是series还是dataframe都内置了.plot()方法,可以结合plt.show()进行很方 ...
js 递归遍历对象插入属性遍历树结构
// 向 info下面每一项插入 isShow test() { const _this = this; _this.info.isShow = false; let iteration = fu ...

利用requests库访问360主页20次

利用requests库访问360主页20次的更多相关文章

随机推荐

热门专题