Python爬虫获取迅雷会员帐号

代码如下：

 import re

 import urllib.request

 import urllib

 import time

 from collections import deque

 head = {

     'Connection': 'Keep-Alive',

     'Accept': 'text/html, application/xhtml+xml, */*',

     'Accept-Language': 'en-US,en;q=0.8,zh-Hans-CN;q=0.5,zh-Hans;q=0.3',

     'User-Agent': 'Mozilla/5.0 (Windows NT 6.3; WOW64; Trident/7.0; rv:11.0) like Gecko'

 }

 visited = set()

 url = 'http://xlfans.com'  # 入口页面, 可以换成别的

 data = None

 full_url=urllib.request.Request(url,data,head)

 urlop = urllib.request.urlopen(full_url)

 data = urlop.read().decode('utf-8')

 temp = re.search(r'href=\"http://xlfans.com/archives/(.{4})\" class=\"thumbnail\">(.*) alt=\"迅雷粉 (.*) 迅雷会员账号分享 共享中', data, re.M|re.I)

 result = re.search(r'href=\"http://xlfans.com/archives/(.{4})', temp.group(), re.M|re.I)

 url = url + "/archives/" + temp.group(1)

 data = None

 full_url=urllib.request.Request(url,data,head)

 urlop = urllib.request.urlopen(full_url)

 data = urlop.read().decode('utf-8')

 save_path = 'D:\\Program Files\\python\\test.txt'

 f_obj = open(save_path, 'w')

 #获取系统时间，来判断是否为周末

 cur_day = time.strftime("%w",time.localtime(time.time()))

 if(cur_day == ''):

     string = "迅雷粉周末迅雷会员账号"

 elif cur_day == '':

     string = "迅雷粉周末迅雷会员账号"

     print(cur_day)

 else:

     string = "迅雷粉专享迅雷会员账号"

 #娘的，是你逼我的

 start = data.find(string)

 data = data[start:]

 data_que = data.split("</p>")

 count = 0

 for i in range(3):

     data_temp = data_que[i]

     num = -1

     acc_que = data_temp.split("<br />")

     for result in acc_que:

         num = num + 1

         if(count != 0):

             if(num == 0):

                 continue

         f_obj.write(result)

         f_obj.write("\n")

     count = count + 1

 f_obj.close()

Python爬虫获取迅雷会员帐号的更多相关文章

迅雷VIP帐号获取小工具
自己写的迅雷vip帐号获取工具,主要是熟悉一下正则表达式下载地址: 迅雷VIP获取工具另附vip防踢补丁,不能使用最新迅雷,我使用的是迅雷尊享版2.0.12.258,使用了一段时间,至少没被踢出来 ...
dedecms--二次开发之会员帐号过期无法登录
最近在二次开发织梦系统的会员功能:要求会员帐号有期限,开始时间以会员添加时间为开始,这样登录的时候需要判断帐号是否过期,原本的织梦系统中是通过$rs = $cfg_ml->CheckUser($ ...
[Python]爬虫获取知乎某个问题下所有图片并去除水印
获取URL 进入某个知乎问题的主页下,按F12打开开发者工具后查看network面板. network面板可以查看页面向服务器请求的资源.资源的大小.加载资源花费的时间以及哪些资源加载失败等信息.还可 ...
如何科学地蹭热点：用python爬虫获取热门微博评论并进行情感分析
前言:本文主要涉及知识点包括新浪微博爬虫.python对数据库的简单读写.简单的列表数据去重.简单的自然语言处理(snowNLP模块.机器学习).适合有一定编程基础,并对python有所了解的盆友阅读 ...
Python爬虫获取知乎图片
前段时间想抓点知乎问题中的图片,了解了下爬虫,发现还是Python的简单方便,于是做了点尝试. #coding=utf-8 import urllib import re def getHtml(ur ...
Python爬虫获取异步加载站点pexels并下载图片(Python爬虫实战3)
1. 异步加载爬虫对于静态页面爬虫很容易获取到站点的数据内容,然而静态页面需要全量加载站点的所有数据,对于网站的访问和带宽是巨大的挑战,对于高并发和大访问访问量的站点来说,需要使用AJAX相关的技术 ...
python爬虫获取百度图片（没有精华，只为娱乐）
python3.7,爬虫技术,获取百度图片资源,msg为查询内容,cnt为查询的页数,大家快点来爬起来.注:现在只能爬取到百度的小图片,以后有大图片的方法,我会陆续发贴. #!/usr/bin/env ...
Python爬虫获取百度贴吧图片
#!/usr/bin/python# -*- coding: UTF-8 -*-import urllibimport re文章来源:https://www.cnblogs.com/Axi8/p/57 ...
【原创】python爬虫获取网站数据并存入本地数据库
#coding=utf-8 import urllib import re import MySQLdb dbnumber = MySQLdb.connect('localhost', 'root', ...

随机推荐

（java）从零开始之-反射Reflect
反射: 当一个字节码文件加载到内存的时候,jvm会对该字节码进行解剖,然后会创建一个对象的Class对象,把字节码文件的信息全部都存储到该Class对象中,我们只要获取到Class对象,我们就可以使用 ...
WampServer修改端口及菜单Localhost
一.修改Apache端口 1.在界面中选Apache,弹出隐藏菜单选项,打开配置文件httpd.conf: 2.找到 Listen 80: 3.将 80 改成 8080(当然自己也可以设定别的不使用的 ...
underscorejs-shuffle学习
2.21 shuffle 2.21.1 语法 _.shuffle(list) 2.21.2 说明返回一个随机乱序的list副本数组, 使用 Fisher-Yates shuffle 来进行随机乱序. ...
magento后台 Fatal error: Call to a member function getId() on a non-object in错误
后台分类管理出现错误 Fatal error: Call to a member function getId() on a non-object in 在数据库中运行以下sql语句 INSERT I ...
PHP面向对象(OOP)：__set()，__get()，__isset()，__unset()四个方法的应用
一般来说,总是把类的属性定义为private,这更符合现实的逻辑.但是, 对属性的读取和赋值操作是非常频繁的,因此在PHP5中,预定义了两个函数”__get()”和”__set()”来获取和赋值其属性 ...
js以json形式提交数据，后台接受
$("#savename").click(function(){ var fananname=$("#editname").val(); var jsonLis ...
C#.NET Winform 通用开发框架
C/S系统开发框架-企业版 V4.0 (Enterprise Edition) 简介: http://www.csframework.com/cs-framework-4.0.htm 视频下载: 百度 ...
newman安装时遇到问题的解决
npm安装newman时系统提示需要安装.net framwork环境通过查询文档安装visual studio express: 于是安装visual studio 2012 express. 安 ...
为iOS 7而开发并支持iOS 6
除了写这本“Developing an iOS 7 Edge”书之外,我还针对iOS 7更新了app,所以我想我应该和大家分享一下我的收获.如果你正在面向iOS 7系统更新应用,同时你的应用还支持iO ...
Oracle问题解决（sqlplus无法登陆）
命令行 sqlplus 无法登陆,常常是用户名/密码错误.监听配置错误或未启动.数据库服务名丢失等等原因. 用户名/密码错误找到自己设的密码这全靠自己创建数据库实例时,备份或记住相关信息若最后没 ...

Python爬虫获取迅雷会员帐号

Python爬虫获取迅雷会员帐号的更多相关文章

随机推荐

热门专题