读书笔记--用Python写网络爬虫01--网络爬虫简介
Firefox简介
- http://www.mozilla.org/
- 中文官网:http://www.firefox.com.cn/ https://www.mozilla.org/zh-CN/firefox/
- Mozilla Firefox,中文俗称“火狐”(正式缩写为Fx或fx,非正式缩写为MF),是一个自由及开放源代码的网页浏览器;
- 支持多种操作系统,如Windows、Mac OS X及GNU/Linux等。
Firefox ESR版本
- Firefox提供了普通版和ESR(Extended Support Release,延长支持)版;
- ESR版本是Mozilla专门为那些无法或不愿每隔六周就升级一次的企业打造;
- Firefox ESR 版的升级周期为42周,而普通Firefox的升级周期为6周;
Firefox完整安装包
- web:http://www.firefox.com.cn/download/
- ftp:http://ftp.mozilla.org/pub/firefox/releases/
- 例如:获取Firefox某个ESR版本完整安装包 http://ftp.mozilla.org/pub/firefox/releases/52.2.0esr/win64/zh-CN/
常用Firefox浏览器插件
Firefox 附加组件: https://addons.mozilla.org/zh-CN/firefox/
下载
- Download Manager (S3):https://addons.mozilla.org/zh-CN/firefox/addon/s3download-statusbar/
- 多线程下载管理器:https://addons.mozilla.org/zh-CN/firefox/addon/multithreaded-download-manager/
网页浏览
- Dark Reader:https://darkreader.org/
GitHub代码查看
- Octotree:https://addons.mozilla.org/zh-CN/firefox/addon/octotree/
- Git History:https://addons.mozilla.org/zh-CN/firefox/addon/github-history/
网页保存
- Save Page WE:https://addons.mozilla.org/zh-CN/firefox/addon/save-page-we/
- 网页剪贴簿:https://addons.mozilla.org/zh-CN/firefox/addon/web-scrapbook/
广告拦截器
- https://addons.mozilla.org/zh-CN/firefox/addon/incognito-adblocker/
- https://addons.mozilla.org/zh-CN/firefox/addon/adblock-for-firefox/
- https://addons.mozilla.org/zh-CN/firefox/addon/adblock-plus/
其他
- Firebug:https://getfirebug.com/
- Selenium IDE:https://addons.mozilla.org/zh-CN/firefox/addon/selenium-ide/
- NoScript安全套件:https://addons.mozilla.org/zh-CN/firefox/addon/noscript/
- JSONView:https://addons.mozilla.org/zh-CN/firefox/addon/jsonview/
Waterfox
- https://www.waterfoxproject.org/
- Waterfox是一个纯64位版的火狐浏览器,使用Firefox官方源码,专门为64位Windows操作系统优化编译而成。
- 内置了最新Flash、Java和Silverlight插件的64位版本,支持任何官方火狐支持的扩展。
读书笔记--用Python写网络爬虫01--网络爬虫简介的更多相关文章
- 读书笔记--用Python写网络爬虫02--数据抓取
抓取(scraping)---爬虫从网页中抽取一些数据用以实现某些用途. 三种抽取网页数据的方法:正则表达式.Beautiful Soup和lxml. 2.1 分析网页 通过浏览器自带选项,查看网页源 ...
- 使用Python写的第一个网络爬虫程序
今天尝试使用python写一个网络爬虫代码,主要是想訪问某个站点,从中选取感兴趣的信息,并将信息依照一定的格式保存早Excel中. 此代码中主要使用到了python的以下几个功能,因为对python不 ...
- Python爬虫-01:爬虫的概念及分类
目录 # 1. 为什么要爬虫? 2. 什么是爬虫? 3. 爬虫如何抓取网页数据? # 4. Python爬虫的优势? 5. 学习路线 6. 爬虫的分类 6.1 通用爬虫: 6.2 聚焦爬虫: # 1. ...
- hadoop学习笔记——用python写wordcount程序
尝试着用3台虚拟机搭建了伪分布式系统,完整的搭建步骤等熟悉了整个分布式框架之后再写,今天写一下用python写wordcount程序(MapReduce任务)的具体步骤. MapReduce任务以来H ...
- 【读书笔记】iOS-网络-测试与操纵网络流量
一,观测网络流量. 观测网络流量的行为叫做嗅探或数据包分析. 1,嗅探硬件. 从iOS模拟器捕获数据包不需要做特别的硬件或网络配置.如果需要捕获这些数据包,那么可以使用嗅探软件来监听回送设备或是用于连 ...
- 用python写一个豆瓣短评通用爬虫(登录、爬取、可视化)
原创技术公众号:bigsai,本文在1024发布,祝大家节日快乐,心想事成. @ 目录 前言 登录 爬取 储存 可视化分析 前言 在本人上的一门课中,老师对每个小组有个任务要求,介绍和完成一个小模块. ...
- 【读书笔记】《写给大忙人看的Java SE 8》——Java8新特性总结
虽然看过一些Java 8新特性的资料,但是平时很少用到,时间长了就忘了,正好借着Java 9的发布,来总结下一些Java 8中的新特性. 接口中的默认方法和静态方法 先考虑一个问题,如何向Java中的 ...
- 读书笔记「Python编程:从入门到实践」_10.文件和异常
10.1 从文件中读取数据 10.1.1 读取整个文件 with open(~) as object: contents=object.read() with open('C:/Users/jou/ ...
- python 进阶读书笔记2 -- python魔法函数
#!/usr/bin/env python# -*- coding: utf-8 -*- class student: def __init__(self, name_list): self.stud ...
随机推荐
- PHP5的对象复制
今天用yii开发程序,一个bug改了一晚上,最后发现问题出在了对象复制机制上,PHP5之前的对象复制只需要$object_a = $object_b即可,但PHP5这样得到的是浅复制,及指针指向,并不 ...
- PHP 读取/导出 CSV文件
工作中经常会有遇到导入/导出的需求,下面是常用的方法.读取CSV文件,可以分页读取,设置读取行数,起始行数即可.导出CSV文件,用两种方法进行实现. /** * 读取CSV文件 * @param st ...
- IOS中扩展机制Category和associative
在ios开发中,有时候会遇到以下的问题,需要在一个类中添加自己的一些属性和方法.一般的做法是重写一个类来继承它,但是有时候就只是需要添加一些简单的属性和方法,那么这样做就显得过于麻烦,其实在IOS中还 ...
- k-近邻算法理解
左图中,绿色圆要被决定赋予哪个类,是红色三角形还是蓝色四方形?如果K=3,由于红色三角形所占比例为2/3,绿色圆将被赋予红色三角形那个类,如果K=5,由于蓝色四方形比例为3/5,因此绿色圆被赋予蓝色四 ...
- struct和typedef struct的用法
我首先想到的去MSDN上看看sturct到底是什么东西,虽然平时都在用,但是每次用的时候都搞不清楚到底这两个东西有什么区别,既然微软有MSDN,我们为什么不好好利用呢,下面是摘自MSDN中的一段话: ...
- Web分析日志分析2
http://www.docin.com/p-649515490.html http://wenku.baidu.com/link?url=kB-83fbl1Zc3Y6U2BYLj-lKMWShe8Z ...
- OpenWrt+nginx+php安装discuz
下面这个图片是本次的硬件资源:一个无线路由器的开发板,一个8G的u盘,一条手机的数据线(可以作为串口和供电使用),一条网线,一个USB Hub. <ignore_js_op> ...
- SQL Standard Based Hive Authorization(基于SQL标准的Hive授权)
说明:该文档翻译/整理于Hive官方文档https://cwiki.apache.org/confluence/display/Hive/SQL+Standard+Based+Hive+Authori ...
- MapReduce执行过程源码分析(一)——Job任务的提交
为了能使源码的执行过程与Hadoop权威指南(2.3版)中章节Shuffle and Sort的分析相对应,Hadoop的版本为0.20.2. 一般情况下我们通过Job(org.apache.hado ...
- uboot mkimage使用详解
mkimage使用详解uboot源代码的tools/目录下有mkimage工具,这个工具可以用来制作不压缩或者压缩的多种可启动映象文件. mkimage在制作映象文件的时候,是在原来的可执行映象文件的 ...