一次scrapy成功停止的信息

2017-11-05 18:52:42 [scrapy.core.engine] INFO: Closing spider (finished)
2017-11-05 18:52:42 [scrapy.statscollectors] INFO: Dumping Scrapy stats:
{'downloader/exception_count': 1,
'downloader/exception_type_count/twisted.internet.error.TCPTimedOutError': 1,
'downloader/request_bytes': 13663857,
'downloader/request_count': 41889,
'downloader/request_method_count/GET': 41889,
'downloader/response_bytes': 935922909,
'downloader/response_count': 41888,
'downloader/response_status_count/200': 41776,
'downloader/response_status_count/301': 25,
'downloader/response_status_count/404': 87,
'dupefilter/filtered': 5335,
'finish_reason': 'finished',
'finish_time': datetime.datetime(2017, 11, 5, 10, 52, 42, 779396),
'item_scraped_count': 41346,
'log_count/DEBUG': 83237,
'log_count/INFO': 49,
'request_depth_max': 1,
'response_received_count': 41533,
'retry/count': 1,
'retry/reason_count/twisted.internet.error.TCPTimedOutError': 1,
'scheduler/dequeued': 41886,
'scheduler/dequeued/disk': 41886,
'scheduler/enqueued': 41886,
'scheduler/enqueued/disk': 41886,
'start_time': datetime.datetime(2017, 11, 5, 10, 10, 13, 465263)}
2017-11-05 18:52:42 [scrapy.core.engine] INFO: Spider closed (finished)

一次scrapy成功停止的信息的更多相关文章

scrapy 知乎用户信息爬虫
zhihu_spider 此项目的功能是爬取知乎用户信息以及人际拓扑关系,爬虫框架使用scrapy,数据存储使用mongo,下载这些数据感觉也没什么用,就当为大家学习scrapy提供一个例子吧.代码地 ...
45.更新一下scrapy爬取工商信息爬虫代码
这里是完整的工商信息采集代码,不过此程序需要配合代理ip软件使用.问题:1.网站对ip之前没做限制,但是采集了一段时间就被检测到设置了反爬,每个ip只能访问十多次左右就被限制访问.2.网站对请求头的检 ...
Scrapy实践----获取天气信息
scrapy是一个非常好用的爬虫框架,它是基于Twisted开发的,Twisted又是一个异步网络框架,既然它是异步的,那么执行起来肯定会很快,所以scrapy的执行速度也不会慢的! 如果你还没没有学 ...
【bug】使用微信分享SDK，配置成功但分享信息异常
使用微信JSD做H5分享功能时,显示配置成功,但分享出去的信息并不是配置中的信息.(p.s. ios 分享后只有一个当前的链接,androd连分享的图标都没有), 最终找的的原因是:分享的链接中,参数 ...
scrapy爬取用户信息 ---崔志才
这个实例还是值得多次看的其流程图如下,还是有一点绕的. 总结: 1 Requst(rul=' xxx ',callback= ' '),仅仅发起某个网页的访问请求,没啥了.剩下的交给回调函数 2 ...
No module named scrapy 成功安装scrapy，却无法import的解决方法
今天本来准备写一个Python的爬虫,然而使用pip安装了Scrapy之后,却无论如何也无法import,显示的结果总是ImportError: No module named Scrapy.网上查阅 ...
网络爬虫之scrapy爬取某招聘网手机APP发布信息
1 引言过段时间要开始找新工作了,爬取一些岗位信息来分析一下吧.目前主流的招聘网站包括前程无忧.智联.BOSS直聘.拉勾等等.有段时间时间没爬取手机APP了,这次写一个爬虫爬取前程无忧手机APP岗位 ...
[jQuery] 通过ajax保存到服务器,成功显示信息.
保存数据到服务器,成功时显示信息. jQuery 代码: $.ajax({ type: "POST", url: "some.php", data: " ...
Python爬虫从入门到放弃（十七）之 Scrapy框架中Download Middleware用法
这篇文章中写了常用的下载中间件的用法和例子.Downloader Middleware处理的过程主要在调度器发送requests请求的时候以及网页将response结果返回给spiders的时候,所以 ...

随机推荐

UVa 11636 - Hello World! 二分，水题难度: 0
题目 https://uva.onlinejudge.org/index.php?option=com_onlinejudge&Itemid=8&page=show_problem&a ...
console.log()显示图片以及为文字加样式
有兴趣的同学可以文章最后的代码复制贴到控制台玩玩. Go for Code 在正常模式下,一般只能向console 控制台输出简单的文字信息.但为了把信息输出得更优雅更便于阅读,除了cosole.lo ...
bzoj3976
题解: 先跑一下Sa 然后再用kmp匹配一下哪一些位置不行然后二分答案代码: #include<bits/stdc++.h> ; using namespace std; int t[ ...
ural1297
题解: 后缀数组 st表处理加速lcp 把串后面加一个不可能出现的字符然后再把串倒过来放在后面暴力枚举中心判断lcp 代码: #include<bits/stdc++.h> usin ...
bzoj1692
题解: 二分最近的不相同然后hash判断是否相同然后贪心代码: #include<bits/stdc++.h> using namespace std; #define ull un ...
inode占用100%时硬盘无法写入文件故障处理
故障现象: 分区无法写入文件. 故障分析: 执行df -h命令发现空间占用不到50%,执行df -hi,发现某分区IUse%值为99%,说明innode已经用完,应该是某些目录下存在大量的小文件导致. ...
bs4 CSS选择器
#https://www.crummy.com/software/BeautifulSoup/bs4/doc/index.zh.html#find-all #beautifulSoup可以解析HTML ...
2018ICPC青岛 E - Plants vs. Zombies (二分+模拟)
ZOJ - 4062 题意:有n个植物排成一排,按顺序植物的编号是1-n,每个植物都有一个生长速率,有一个机器人,机器人可以走m步,每走一步,这个机器人就会浇一次水,浇一次水那个植物就会长自身的生长 ...
如何用UltraEdit查看并修改Oracle导出的dump文件的字符集
如何查询dmp文件的字符集用oracle的exp工具导出的dmp文件也包含了字符集信息,dmp文件的第2和第3个字节记录了dmp文件的字符集.如果dmp文件不大,比如只有几M或几十M,可以用Ultr ...
C++面试常见考点
这两周参加了3家公司的面试,一家是做嵌入式的外企,一家是做智能家居的初创公司,一家是做网络分析的公司. 通过参加面试,越发的觉得语言只是基础,虽然都是计算机领域,但是不同的业务肯能用到的技术不同,所以 ...

一次scrapy成功停止的信息

一次scrapy成功停止的信息的更多相关文章

随机推荐

热门专题