Python爬虫刷回复

最近闲的无聊，就想着去看看爬虫，顺着爬虫顺利的做到了模拟登录、刷帖子等等，这里简要说一下。
使用Python2.7写的爬虫，对某论坛做模拟登陆和刷帖子、回复等等，由于之前是没有接触过爬虫，这次之后感觉爬虫很强大，能做很多事，先来贴几张图。

由于论坛不让使用相同的文字，所以调用了笑话的api，达到不同文字的目的。
该论坛使用的是cookie，所以先去获取一下cookie，顺便将cookie写到文件里面。

'''

获取cookie

'''

def get_cookie(login_data, url, testurl=None):

    filename = "cookie"

    cookie = cookielib.MozillaCookieJar(filename)

    hadler = urllib2.HTTPCookieProcessor(cookie)

    opener = urllib2.build_opener(hadler)

    post_data = urllib.urlencode(

        {'logname': 123456, "logpass": "123456", "action": "login", })

    url = 'http://*****.me/waplogin.aspx'

    opener.open(url, post_data)

    cookie.save(ignore_discard=True, ignore_expires=True)

    print("获取成功")

    # print(opener.open(testurl).read())

先要分析该网站登录地址，登录需要的参数，如上代码
获得cookie之后，分析该论坛的回复参数，该论坛采用的是post提交，需要有帖子id，回复内容等等，分析之后得到如下代码
代码先加载文件里面的cookie，然后调用了haha这个笑话api，当然我已经将这个api的json进行了处理，这里只要笑话内容就行。

'''

回复帖子

'''

def post_reply():

    filename = "cookie"

    cookie = cookielib.MozillaCookieJar(filename)

    cookie.load(filename, ignore_discard=True, ignore_expires=True)

    handler = urllib2.HTTPCookieProcessor(cookie)

    opener = urllib2.build_opener(handler)

    num=0

    for i in range(216255, 800000):

        num = num + 1

        huifu = urllib.urlencode(

            {'sendmsg': 0, "content": str(haha(num)), "action": "add", "id": str(i), "classid": 177})

        gradeUrl = 'http://******.me/bbs/book_re.aspx'

        result = opener.open(gradeUrl)

        print result.read()

        print "当前第" + str(num) + "" + "次回帖"

        print("当前帖子id" + str(i))

        sleep(1)

发帖子代码：



'''

发帖子(普通帖子或者加悬赏分的帖子：并不是悬赏板块的帖子)

'''

def post_articles(book_title, book_content, classid=177, sendmoney=0):

    filename = "cookie"

    cookie = cookielib.MozillaCookieJar(filename)

    cookie.load(filename, ignore_discard=True, ignore_expires=True)

    handler = urllib2.HTTPCookieProcessor(cookie)

    opener = urllib2.build_opener(handler)

    post_articles = urllib.urlencode(

        {'sendmsg': 0, "book_title": str(book_title), "action": "gomod", "siteid": "1000",

         "book_content": str(book_content), "classid": classid, "sendmoney": sendmoney})

    gradeUrl = 'http://*****.me/bbs/book_view_add.aspx'

    result = opener.open(gradeUrl, post_articles)

    print(result.read())

将这些代码进行进行调用就可以去刷回复了。

Python爬虫刷回复的更多相关文章

python 爬虫刷访问量
import urllib.requestimport time # 使用build_opener()是为了让python程序模仿浏览器进行访问opener = urllib.request.buil ...
利用Python爬虫刷店铺微博等访问量最简单有效教程
一.安装必要插件测试环境:Windows 10 + Python 3.7.0 (1)安装Selenium pip install selenium (2)安装Requests pip install ...
Python爬虫帮你打包下载所有抖音好听的背景音乐，还不快收藏一起听歌【华为云技术分享】
版权声明:本文为博主原创文章,遵循CC 4.0 BY-SA版权协议,转载请附上原文出处链接和本声明. 本文链接:https://blog.csdn.net/devcloud/article/detai ...
python爬虫学习(7) —— 爬取你的AC代码
上一篇文章中,我们介绍了python爬虫利器--requests,并且拿HDU做了小测试. 这篇文章,我们来爬取一下自己AC的代码. 1 确定ac代码对应的页面如下图所示,我们一般情况可以通过该顺序 ...
[python爬虫] Selenium定向爬取海量精美图片及搜索引擎杂谈
我自认为这是自己写过博客中一篇比较优秀的文章,同时也是在深夜凌晨2点满怀着激情和愉悦之心完成的.首先通过这篇文章,你能学到以下几点: 1.可以了解Python简单爬取图片的一些思路和方法 ...
【Python爬虫】入门知识
爬虫基本知识这阵子需要用爬虫做点事情,于是系统的学习了一下python爬虫,觉得还挺有意思的,比我想象中的能干更多的事情,这里记录下学习的经历. 网上有关爬虫的资料特别多,写的都挺复杂的,我这里不打 ...
Python爬虫实例：爬取猫眼电影——破解字体反爬
字体反爬字体反爬也就是自定义字体反爬,通过调用自定义的字体文件来渲染网页中的文字,而网页中的文字不再是文字,而是相应的字体编码,通过复制或者简单的采集是无法采集到编码后的文字内容的. 现在貌似不少网 ...
Python爬虫基础之认识爬虫
一.前言爬虫Spider什么的,老早就听别人说过,感觉挺高大上的东西,爬网页,爬链接~~~dos黑屏的数据刷刷刷不断地往上冒,看着就爽,漂亮的校花照片,音乐网站的歌曲,笑话.段子应有尽有,全部都过来 ...
Python爬虫之诗歌接龙
介绍本文将展示如何利用Python爬虫来实现诗歌接龙. 该项目的思路如下: 利用爬虫爬取诗歌,制作诗歌语料库: 将诗歌分句,形成字典:键(key)为该句首字的拼音,值(value)为该拼音对 ...

随机推荐

Assignment2：因果图法的介绍与示例分析
一. 黑盒测试:是一种常用的软件测试方法,它将被测软件看作一个打不开的黑盒,主要根据功能需求设计测试用例,进行测试.几种常用的黑盒测试方法和黑盒测试工具有,等价类划分法.边界值分析法.因果图法.决策表 ...
Java-Maven（九）：Maven 项目pom文件引入工程根目录下lib文件夹下的jar包
由于项目一些特殊需求,pom依赖的包可能是非Maven Repository下的包文件,因此无法自己从网上下载.此时,我们团队git上对该jar使用. Maven项目pom引入lib下jar包在ec ...
pdf 中内容的坐标系
PDF Page Coordinates (page size, field placement, etc.) AcroForm, Basics, Automation Page coordinate ...
Tosca :配置环境参数
# 跟Modules TestCases并列 ,右键创建 #再右键创建配置(结构自己安排) #再创建配置参数 #使用配置参数 #引用配置的环境参数
c++异常——学习笔记
1.异常 throw抛出字符串最好的是:throw抛出对象. catch(...){} 2.使用标准异常类 #include<new> bitset 自己写一个异常设计自己异常类堆栈 ...
将移远通信的EC20驱动移植到NUC972上（转）
源: 将移远通信的EC20驱动移植到NUC972上
海思 Hi3516A Hi3518E V200 芯片介绍
海康是生产监控摄像头和硬盘录像机的,海思是提供机器里芯片的,海思属于华为的. http://www.hisilicon.com/en/Products/ProductList/Surveillance ...
Qt编写自定义控件60-声音波形图
一.前言这个控件源自于一个音乐播放器,在写该音乐播放器的时候,需要将音频的数据转换成对应的频谱显示,采用的fmod第三方库来处理(fmod声音系统是为游戏开发者准备的革命性音频引擎,非常强大和牛逼) ...
RabbitMQ 清除全部队列及消息
前言安装RabbitMQ后可访问:http://{rabbitmq安装IP}:15672使用(默认的是帐号guest,密码guest.此账号只能在安装RabbitMQ的机器上登录,无法远程访问登录. ...
Linux记录-批量安装LNMP（转载）
#!/bin/bash # Describe: This is a one - button installation service script # 提示:使用此脚本时,尽量先选择第一项配置Yum ...

Python爬虫刷回复

Python爬虫刷回复的更多相关文章

随机推荐

热门专题