python抓取汇率
# -*- coding: utf-8 -*-
"""
获取实时汇率
Created on Fri Oct 18 13:11:40 2013 @author: alala
""" import httplib
import re
import MySQLdb
import datetime URL = 'fx.cmbchina.com' #网站名
PATH = '/hq/' #页面路径
HOST = 'localhost' #数据库地址(ip)
DB = "money" #数据库名称
USER = 'root' #数据库用户名
PSWD = 'sheet' #数据库密码 httpClient = None try:
#抓去网页内容
httpClient = httplib.HTTPConnection(URL, 80, timeout=30)
httpClient.request('GET', '/hq/')
response = httpClient.getresponse()
html = response.read()
#print html #用正则表达式抓去汇率数据
reg = re.compile(r"""
<tr>\s*<td\s+class="fontbold">\s*(?P<name>\S+)\s*</td>\s* #交易币
<td\s+align="center">\s*(?P<unit>\d+)\s*</td>\s* #交易币单位
<td\s+align="center"\s+class="fontbold">\s*(?P<base>\S+)\s*</td>\s* #基本币
<td\s*class="numberright">\s*(?P<midPrice>\d+\.\d+)\s*</td>\s* #中间价
<td\s*class="numberright">\s*(?P<sellPrice>\d+\.\d+)\s*</td>\s* #卖出价
<td\s*class="numberright">\s*(?P<buyPrice1>\d+\.\d+)\s*</td>\s* #现汇买入价
<td\s*class="numberright">\s*(?P<buyPrice2>\d+\.\d+)\s*</td>\s* #现钞买入价
<td\s*align="center">\s*(?P<time>\d+:\d+:\d+)\s*</td>\s* #时间
""", re.MULTILINE | re.X)
rows = reg.findall(html)
#打印汇率数据
for r in rows:
print ','.join(map(str,r)), '\n' #数据库操作
#确保mysqldb已经安装,可以用下面的命令安装
#pip install MySQL-python #建立和数据库系统的连接
conn = MySQLdb.connect(host=HOST, user=USER,passwd=PSWD) #获取操作游标
cursor = conn.cursor()
#执行SQL,创建一个数据库.
cursor.execute("CREATE DATABASE IF NOT EXISTS " + DB) #选择数据库
conn.select_db(DB);
#执行SQL,创建一个数据表.
cursor.execute("""CREATE TABLE IF NOT EXISTS exchange_rate(
name VARCHAR(50) COMMENT '交易币' PRIMARY KEY,
unit INT COMMENT '交易币单位',
base VARCHAR(50) COMMENT '基本币',
midPrice FLOAT COMMENT '中间价',
sellPrice FLOAT COMMENT '卖出价',
buyPrice1 FLOAT COMMENT '现汇买入价',
buyPrice2 FLOAT COMMENT '现钞买入价',
time DATETIME COMMENT '时间' ) """)
records = []
for r in rows:
(name,unit,base,midPrice,sellPrice,buyPrice1,buyPrice2,time) = r
time = datetime.datetime.strptime(datetime.datetime.now().strftime('%Y-%m-%d')
+ " " + time,'%Y-%m-%d %H:%M:%S')
record = (name,int(unit),base,float(midPrice),float(sellPrice),
float(buyPrice1),float(buyPrice2),time)
records.append(record)
#print records
#更新汇率
cursor.executemany("REPLACE exchange_rate VALUES(%s,%s,%s,%s,%s,%s,%s,%s)"
,records);
conn.commit() #关闭连接,释放资源
cursor.close(); except Exception,e:
print e
finally:
if httpClient:
httpClient.close()
python抓取汇率的更多相关文章
- Python 抓取网页并提取信息(程序详解)
最近因项目需要用到python处理网页,因此学习相关知识.下面程序使用python抓取网页并提取信息,具体内容如下: #---------------------------------------- ...
- 使用 Python 抓取欧洲足球联赛数据
Web Scraping在大数据时代,一切都要用数据来说话,大数据处理的过程一般需要经过以下的几个步骤 数据的采集和获取 数据的清洗,抽取,变形和装载 数据的分析,探索和预测 ...
- python抓取性感尤物美女图
由于是只用标准库,装了python3运行本代码就能下载到多多的美女图... 写出代码前面部分的时候,我意识到自己的函数设计错了,强忍继续把代码写完. 测试发现速度一般,200K左右的下载速度,也没有很 ...
- python抓取网页例子
python抓取网页例子 最近在学习python,刚刚完成了一个网页抓取的例子,通过python抓取全世界所有的学校以及学院的数据,并存为xml文件.数据源是人人网. 因为刚学习python,写的代码 ...
- Python抓取页面中超链接(URL)的三中方法比较(HTMLParser、pyquery、正则表达式) <转>
Python抓取页面中超链接(URL)的3中方法比较(HTMLParser.pyquery.正则表达式) HTMLParser版: #!/usr/bin/python # -*- coding: UT ...
- 如何用python抓取js生成的数据 - SegmentFault
如何用python抓取js生成的数据 - SegmentFault 如何用python抓取js生成的数据 1赞 踩 收藏 想写一个爬虫,但是需要抓去的的数据是js生成的,在源代码里看不到,要怎么才能抓 ...
- 关于python抓取google搜索结果的若干问题
关于python抓取google搜索结果的若干问题 前一段时间一直在研究如何用python抓取搜索引擎结果,在实现的过程中遇到了很多的问题,我把我遇到的问题都记录下来,希望以后遇到同样问题的童 ...
- 用python抓取智联招聘信息并存入excel
用python抓取智联招聘信息并存入excel tags:python 智联招聘导出excel 引言:前一阵子是人们俗称的金三银四,跳槽的小朋友很多,我觉得每个人都应该给自己做一下规划,根据自己的进步 ...
- python抓取月光博客的全部文章而且依照标题分词存入mongodb中
猛击这里:python抓取月光博客的全部文章
随机推荐
- Android计时器TimerTask,Timer,Handler
Android计时器TimerTask,Timer,若要在TimerTask中更新主线程UI,鉴于Android编程模型不允许在非主线程中更新主线程UI,因此需要结合Android的Handler实现 ...
- HTML5开发规范
1.总体规范——采用html5的结构标签进行页面布局,注意结构的语义化,并注意页面大纲的层级结构.使用css3.0进行样式的设计. a.网页大纲查询网址http://gsnedders.html5.o ...
- asp.net中两款文本编辑器NicEdit和Kindeditor
过Web开发的朋友相信都使用过富文本编辑器,比较出名的CuteEditor和CKEditor很多人应该已经使用过,在功能强大的同时需要加载的东西也变得很多.下面要推荐的两款富文本编辑器都是使用JS编写 ...
- C# 标准查询表达式
一.标准查询运算符 1.C#提供了标准查询运算符,例如我想选择专利一系列(pantents)中以年份19开头的专利,可以用如下语句: IEnumerable<Patent> pantent ...
- 第十七章 调试及安全性(In .net4.5) 之 程序诊断
1. 概述 生产环境中的程序,也是不能保证没有问题的.为了能方便的找出问题,.net提供了一些特性来进行程序诊断. 这些特性包括:logging.tracing .程序性能分析(profiling) ...
- python 序列的方法
作者:Vamei 出处:http://www.cnblogs.com/vamei 欢迎转载,也请保留这段声明.谢谢! 在快速教程中,我们了解了最基本的序列(sequence).回忆一下,序列包含有定值 ...
- python 函数对象(函数式编程 lambda、map、filter、reduce)、闭包(closure)
1.函数对象 作者:Vamei 出处:http://www.cnblogs.com/vamei 欢迎转载,也请保留这段声明.谢谢! 秉承着一切皆对象的理念,我们再次回头来看函数(function).函 ...
- 《高性能javascript》读书笔记:P1减少跨作用域的变量访问
前端优化,有两个意义:1.为了让用户在浏览网页时获得更好的体验 2.降低服务器端的访问压力,节省网络流量. 除了换个好主机连上个千兆网这样的硬件问题,优化部分的实现方式目前也大致两种,一种是页面级别的 ...
- C,C++回文字符串判断(字符串指针的用法)
功能:输入一个字符串,判断是否为回文. 主要锻炼指针的用法. 1.C版 #include<stdio.h> int main() { ]; char a; ,flag=; while((a ...
- 转 在SQL Server中创建用户角色及授权(使用SQL语句)
目录 要想成功访问 SQL Server 数据库中的数据 我们需要两个方面的授权 完整的代码示例 使用存储过程来完成用户创建 实例 要想成功访问 SQL Server 数据库中的数据, 我们需要两个 ...