urllib.urlretrieve远程下载

下面我们再来看看 urllib 模块提供的 urlretrieve() 函数。urlretrieve() 方法直接将远程数据下载到本地。

>>> help(urllib.urlretrieve)

Help on function urlretrieve in module urllib:

urlretrieve(url, filename=None, reporthook=None, data=None)

参数 finename 指定了保存本地路径（如果参数未指定，urllib会生成一个临时文件保存数据。）
参数 reporthook 是一个回调函数，当连接上服务器、以及相应的数据块传输完毕时会触发该回调，我们可以利用这个回调函数来显示当前的下载进度。
参数 data 指 post 到服务器的数据，该方法返回一个包含两个元素的(filename, headers)元组，filename 表示保存到本地的路径，header 表示服务器的响应头。

下面通过例子来演示一下这个方法的使用，这个例子将 google 的 html 抓取到本地，保存在 D:/google.html 文件中，同时显示下载的进度。

 import urllib

 def cbk(a, b, c):

     '''回调函数

     @a: 已经下载的数据块

     @b: 数据块的大小

     @c: 远程文件的大小

     '''

     per = 100.0 * a * b / c

     if per > 100:

         per = 100

     print '%.2f%%' % per

 url = 'http://www.google.com'

 local = 'd://google.html'

 urllib.urlretrieve(url, local, cbk)

下面是 urlretrieve() 下载文件实例，可以显示下载进度。

 #!/usr/bin/python

 #encoding:utf-8

 import urllib

 import os

 def Schedule(a,b,c):

     '''''

     a:已经下载的数据块

     b:数据块的大小

     c:远程文件的大小

    '''

     per = 100.0 * a * b / c

     if per > 100 :

         per = 100

     print '%.2f%%' % per

 url = 'http://www.python.org/ftp/python/2.7.5/Python-2.7.5.tar.bz2'

 #local = url.split('/')[-1]

 local = os.path.join('/data/software','Python-2.7.5.tar.bz2')

 urllib.urlretrieve(url,local,Schedule)

 ######output######

 #0.00%

 #0.07%

 #0.13%

 #0.20%

 #....

 #99.94%

 #100.00%

　　通过上面的练习可以知道，urlopen() 可以轻松获取远端 html 页面信息，然后通过 python 正则对所需要的数据进行分析，匹配出想要用的数据，在利用urlretrieve() 将数据下载到本地。对于访问受限或者对连接数有限制的远程 url 地址可以采用 proxies（代理的方式）连接，如果远程数据量过大，单线程下载太慢的话可以采用多线程下载，这个就是传说中的爬虫。

urllib.urlretrieve远程下载的更多相关文章

【py网页】urllib.urlretrieve远程下载
下面我们再来看看 urllib 模块提供的 urlretrieve() 函数.urlretrieve() 方法直接将远程数据下载到本地. 1 >>> help(urllib.urlr ...
python urllib从远程服务器下载文件到本地
#!/usr/bin/env python #-*-coding:utf--*-' #Filename:download_file.py import sys,os import urllib def ...
urllib.request.urlretrieve()用于下载制定url内容到本地
函数:urllib.urlretrieve(url[, filename[, reporthook[, data]]]) 参数说明: url:外部或者本地url ,url中不要含有中文,好像会出错.f ...
Python urllib urlretrieve函数解析
Python urllib urlretrieve函数解析利用urllib.request.urlretrieve函数下载文件觉得有用的话,欢迎一起讨论相互学习~Follow Me 参考文献 Ur ...
urllib.urlretrieve的用法
urllib.urlretrieve(url, local, cbk) urllib.urlretrieve(p,'photo/%s.jpg'%p.split('/')[-4]) url要下载的网站 ...
PHP实现远程下载文件到本地
PHP实现远程下载文件到本地投稿:hebedich 字体:[增加减小] 类型:转载经常写采集器发布接口需要使用到远程附件的功能,所以自己写了一个PHP远程下载文件到本地的函数,一般情况下已经 ...
PHP CURL实现远程下载文件到本地
<?php //$result=httpcopy('http://www.phpernote.com/image/logo.gif'); echo '<pre>';print_r($ ...
LINUX安装SVN+添加自动同步+远程下载最新代码
LINUX安装SVN+添加自动同步+远程下载最新代码---------------------1. 新建一个用户:svnroot ,以下操作非特别说明皆为root用户操作--------------- ...
Python 模块功能paramiko SSH 远程执行及远程下载
模块 paramiko paramiko是一个用于做远程控制的模块,使用该模块可以对远程服务器进行命令或文件操作,值得一说的是,fabric和ansible内部的远程管理就是使用的paramiko来现 ...

随机推荐

【我的Android进阶之旅】Android Studio查看Logcat时，如果一行Log太长如何换行显示？
使用Android Studio一段时间了,还有很多小技巧没有掌握.今天又发现了一个比较好用的小技巧,这里分享出来. 1.Android Studio默认显示效果比如我们用Logcat来查看打印的L ...
Django组件 - cookie、session、用户认证组件
一.cookie 1.会话跟踪技术 1)什么是会话跟踪技术我们需要先了解一下什么是会话!可以把会话理解为客户端与服务器之间的一次会晤,在一次会晤中可能会包含多次请求和响应.例如你给10086打个电话 ...
假设做一个精美的Login界面(攻克了一EditText自带clear的功能,相似iphone的UITextField)
先上图: XML为: <LinearLayout xmlns:android="http://schemas.android.com/apk/res/android" ...
Linux运维工程师：30道面试题整理
1.linux 如何挂在 windows 下的共享目录 mount.cifs //192.168.1.3/server /mnt/server -o user=administrator,pass=1 ...
Redis五（其他操作命令）
其他常用操作 delete(*names) # 根据删除redis中的任意数据类型 exists(name) # 检测redis的name是否存在 keys(pattern='*') # 根据模型获取 ...
Generating Gaussian Random Numbers(转)
Generating Gaussian Random Numbers http://www.taygeta.com/random/gaussian.html This note is about th ...
14链表中倒数第k个结点
题目描述输入一个链表,输出该链表中倒数第k个结点. 思路: 快慢指针快指针先走k 步, 然后快慢指针一起走当快指针走到null 时, 慢指针就是所求的倒数第k个节点 tips: 判断k是否 ...
Javascript中call()和apply()的用法 ----2
前言 call 和 apply 都是为了改变某个函数运行时的 context 即上下文而存在的,换句话说,就是为了改变函数体内部 this 的指向.call 和 apply二者的作用完全一样,只是接受 ...
剑指offer编程题66道题 36-66
36.两个链表的第一个公共节点题目描述输入两个链表,找出它们的第一个公共结点. 1.具有重合节点的两个链表是一个Y字性,用两个堆栈放这两个链表,从尾部开始遍历,直到遍历到最后一个重合节点. 这种算 ...
EasyUI：所有的图标
EasyUI:所有的图标所有的图标在 jquery-easyui-1.2.6/themes/icons 目录下: jquery-easyui-1.2.6/themes/icon.css .icon- ...

urllib.urlretrieve远程下载

urllib.urlretrieve远程下载的更多相关文章

随机推荐

热门专题