获取web.py上面的示例code

import requests

import re

import os.path

#取得文件名和内容对应字典

def getCode(url):

    pattern=re.compile(r'<h\d>([^<]+)?</h\d>\n*<pre><code>[^<]*</code>{1}?',re.S)

    dic={}

    r=requests.get(url)

    if r.status_code==200:

        for g in re.finditer(pattern,r.text):

            dic[g.group(1)]=g.group(0)

    return dic

#输出到文件中

def saveFile(saveDir,dic):

    if not os.path.isdir(saveDir):

        os.makedirs(saveDir)

    for key in dic:

        print key,dic[key]

        #

        outPath=saveDir

        fileName=key

        rIndex=key.rfind("/")

        if rIndex!=-1:

            outPath=outPath+"\\"+key[:rIndex]

            fileName=key[rIndex+1:]

            if not os.path.isdir(outPath):

                os.makedirs(outPath)

        outFile=open(outPath+"\\"+fileName,'w')

        beginIndex=dic[key].find("<code>")

        endIndex=dic[key].find("</code>")

        if beginIndex==-1 or endIndex==-1:

            print "<code> have not"

            return

        subs=dic[key][beginIndex+6:endIndex]

        outFile.write(subs)

        outFile.close()

url1='http://webpy.org/skeleton/0.3'

url2='http://webpy.org/src/blog/0.3'

url3='http://webpy.org/src/todo-list/0.3'

url4='http://webpy.org/src/wiki/0.3'

urls=(url1,url2,url3,url4)

for url in urls:

    #取得文件名和内容对应字典

    dic=getCode(url)

    #相对目录不变

    proPath=url.replace("http://","\\").replace("/","\\")

    #保存根目录设定在【f:\pyworkspace】下

    saveFile(r'f:\pyworkspace'+proPath,dic)

获取web.py上面的示例code的更多相关文章

python获取动态网站上面的动态加载的数据（初级）
我们在处理一些网站数据的时候,有时候我们需要的数据很多都是动态加载的,而不都是静态的,以下以一个实例来介绍简单的获取动态数据,首先申明本人小白,还在学习python中,这个方法还是比较笨拙的,但是对于 ...
web.py上传文件并解压
有个需求是从php端上传zip文件到python端并且解压到指定目录,以下是解决方法 1.python端,使用的web.py def POST(self): post_data = web.input ...
python获取动态网站上面的动态加载的数据（selenium+Firefox）
最近突然想到以前爬取百度学术上的参考文献,大家可以看一下以前我的写的博客:http://www.cnblogs.com/ybf-yyj/p/7351493.html,但是如果利用这个方法,太痛苦了,需 ...
简单而直接的Python web 框架：web.py
web.py 是一个Python 的web 框架,它简单而且功能强大.web.py 是公开的,无论用于什么用途都是没有限制的. 先让大家感受一下web.py 的简单而强大: import web ur ...
如何批量清除128组节点db上面的过期的binlog，释放磁盘空间。(转)
如果10台以内的db的话,自己手动ssh进去,clean就足以,但是上百台呢,就要写脚本了.大概思路:在一台db跳转机上面, 写一个脚本,访问slave,远程获取正在复制的master上面的binl ...
清理：db上面的过期的binlog，释放磁盘空间。（转)
如果10台以内的db的话,自己手动ssh进去,clean就足以,但是上百台呢,就要写脚本了.大概思路:在一台db跳转机上面, 写一个脚本,访问slave,远程获取正在复制的master上面的binl ...
Aaron Swartz Rewriting Reddit中关于web.py的创建思路
这天才少年居然自杀了,哎原文点这 So how should things work? The first principle is that code should be clear and si ...
jQuery Ajax使用FormData上传文件和其他数据，后端web.py获取
参考博文: 通过jQuery Ajax使用FormData对象上传文件方法一:使用<form>表单初始化FormData对象方式上传文件前端(JQuery): <form enc ...
context.getResourceAsStream获取的是部署在服务器上面的文件位置而不是我们本地的工程位置意思是说获取的都是web下面的文件位置
context.getResourceAsStream获取的是部署在服务器上面的文件位置而不是我们本地的工程位置意思是说获取的都是web下面的文件位置

随机推荐

Intersection of Two Linked Lists——经典问题
Write a program to find the node at which the intersection of two singly linked lists begins. For ex ...
JAVA 语言类的特性（成员、重载、构造方法、静态成员）
一.类的私有成员和公有成员 1.私有成员修饰符private 如果在类的声明前加上修饰符private,则无法从该类的外部访问到该类的内部成员,而只能被该类自身访问和修改,而不嗯那个被其他类, ...
new、operator new、placement new
首先我们区分下几个容易混淆的关键词: new.operator new.placement new new和delete操作符我们应该都用过,它们是对堆中的内存进行申请和释放,而这两个都是不能被重载的 ...
Standard Java集合类问题待整理
1. HashSet.LinkedHashSet和TreeSet HashSet采用散列函数对元素进行排序,是专门为快速查询而设计的.存入HashSet的对象必须定义hashCode方法. TreeS ...
ASP.NET总结——更改后
这篇重新整理的总结,我做了很久,也在草稿箱中放了很久,一直感觉没有达到和老师谈话后的水平,感觉还是需要增加一些修改,希望读者能提出宝贵意见.既这篇博客之前,我发表了一篇ASP.net的总结,在结构上, ...
【最大权森林/Kruskal】POJ3723-Conscription
[题目大意] 招募m+n个人每人需要花费$10000,给出一些关系,征募某个人的费用是原价-已招募人中和他亲密值的最大值,求最小费用. [思路] 人与人之间的亲密值越大,花费越少,即求出最大权森林,可 ...
Codeforces Beta Round #2 B. The least round way dp
B. The least round way 题目连接: http://www.codeforces.com/contest/2/problem/B Description There is a sq ...
Manthan, Codefest 16 E. Startup Funding ST表二分数学
E. Startup Funding 题目连接: http://codeforces.com/contest/633/problem/E Description An e-commerce start ...
HDU 4658 Integer Partition （2013多校6 1004题）
Integer Partition Time Limit: 2000/1000 MS (Java/Others) Memory Limit: 32768/32768 K (Java/Others ...
css/js(工作中遇到的问题)-6
页面resize方法 if(document.createEvent) { const event = document.createEvent ("HTMLEvents"); e ...

获取web.py上面的示例code

获取web.py上面的示例code的更多相关文章

随机推荐

热门专题