Ubuntu定时执行任务（定时爬取数据）

cron是一个Linux下的后台进程，用来定期的执行一些任务。因为我用的是Ubuntu，所以这篇文章中的所有命令也只能保证在Ubuntu下有效。

1：编辑crontab文件，用来存放你要执行的命令


sudo crontab -e

2：第一次用这个命令，会让你选择文本编辑器，我选的是vim
（输入数字选择就是了！）

3：添加执行命令


0 7 * * *  /usr/bin/python /root/world.py

这句话的意思就是每天早上七点都会自动执行这个脚本！

4：重启cron来应用这个计划任务


sudo service cron restart

0|1corntab详细说明

1：crontab文件的基本格式如下所示

* * * * * command

分 时 天 月 周 命令

crontab中的每一行代表一个定期执行的任务，分为6个部分。前5个部分表示何时执行命令，最后一个部分表示执行的命令。每个部分以空格分隔，除了最后一个部分（命令）可以在内部使用空格之外，其他部分都不能使用空格。前5个部分分别代表：分钟，小时，天，月，星期，每个部分的取值范围如下：
分钟 0 - 59
小时 0 - 23
天 1 - 31
月 1 - 12
星期 0 - 6 0表示星期天
* （星号）表示任意值，比如在小时部分填写 * 代表任意小时（每小时）
，（逗号）可以允许在一个部分中填写多个值，比如在分钟部分填写 1,3 表示一分钟或三分钟
/（斜线）一般配合 * 使用，代表每隔多长时间，比如在小时部分填写 /2 代表每隔两分钟。所以 /1 和 * 没有区别

2：crontab例子
（1）30 20 * * * date >> /home/date.log //每天的20:30将日期信息追加home目录下的date.log中
（2）5 20 13,14 * * date >> /home/date.log //每月的13日，14日20:5分将日期信息最追加home目录下的date.log中
（3）0,10 10,12 * * * date >> /home/date.log //每天10点至12点之间，隔10分钟将日期信息最追加home目录下的date.log中
（4）/5 * * * date >> /home/date.log //每5分钟将日期信息最追加home目录下的date.log中

3：crontab是UNIX系统下定期执行任务的触发器。用户把要定期执行的任务记录在这个文件下面，然后crond定期的去检查这个定期执行列表，有要执行的工作时便自动执行。
通过man crontab可以查看到下面的信息
（1）/etc/crond.allow 表示的是允许使用crontab的用户列表
（2）/etc/crond.deny 表示的是不允许使用crontab的用户列表

4： crontab常用的几个命令格式
crontab -l //显示用户的crontab文件的内容
crontab -e //编辑用户的crontab文件的内容
crontab -r //删除用户的crontab文件

实例分析：

更换成unix的换行符

vim world.py

查看格式

:set ff

发现是dos，我们要将其更换成unix

:set ff=unix

1 创建脚本文件world.py，在文件开头需要加上下面一行

　#!/usr/bin/python

# encoding=utf-8

上面这行的作用是说明使用那个解释器来执行该文件，如果不知道python解释器在哪，可以使用命令which python来查看

设置编码格式

2 给该文件添加可执行的权限

　　chmod +x test.py

　　注意：在脚本文件中如果涉及文件操作，请使用绝对路径，我就是在这上面掉坑里了。

3 添加计划任务

　　crontab -e

　　在文件中追加一行，* 7 * * * * /usr/bin/python /root/world.py

　　保存退出，:wq

4 重启cron服务

　　service cron restart

结束

Ubuntu定时执行任务（定时爬取数据）的更多相关文章

node.js爬取数据并定时发送HTML邮件
node.js是前端程序员不可不学的一个框架,我们可以通过它来爬取数据.发送邮件.存取数据等等.下面我们通过koa2框架简单的只有一个小爬虫并使用定时任务来发送小邮件! 首先我们先来看一下效果图差不 ...
Python使用Scrapy框架爬取数据存入CSV文件(Python爬虫实战4)
1. Scrapy框架 Scrapy是python下实现爬虫功能的框架,能够将数据解析.数据处理.数据存储合为一体功能的爬虫框架. 2. Scrapy安装 1. 安装依赖包 yum install g ...
如何提升scrapy爬取数据的效率
在配置文件中修改相关参数: 增加并发默认的scrapy开启的并发线程为32个,可以适当的进行增加,再配置文件中修改CONCURRENT_REQUESTS = 100值为100,并发设置成了为100. ...
借助Chrome和插件爬取数据
工具 Chrome浏览器 TamperMonkey ReRes Chrome浏览器 chrome浏览器是目前最受欢迎的浏览器,没有之一,它兼容大部分的w3c标准和ecma标准,对于前端工程师在开发过程 ...
web scraper——简单的爬取数据【二】
web scraper——安装[一] 在上文中我们已经安装好了web scraper现在我们来进行简单的爬取,就来爬取百度的实时热点吧. http://top.baidu.com/buzz?b=1&a ...
关于js渲染网页时爬取数据的思路和全过程（附源码）
于js渲染网页时爬取数据的思路首先可以先去用requests库访问url来测试一下能不能拿到数据,如果能拿到那么就是一个普通的网页,如果出现403类的错误代码可以在requests.get()方法里 ...
【Spider】使用CrawlSpider进行爬虫时，无法爬取数据，运行后很快结束，但没有报错
在学习<python爬虫开发与项目实践>的时候有一个关于CrawlSpider的例子,当我在运行时发现,没有爬取到任何数据,以下是我敲的源代码:import scrapyfrom UseS ...
【个人】爬虫实践，利用xpath方式爬取数据之爬取虾米音乐排行榜
实验网站:虾米音乐排行榜网站地址:http://www.xiami.com/chart 难度系数:★☆☆☆☆ 依赖库:request.lxml的etree (安装lxml:pip install ...
python模拟浏览器爬取数据
爬虫新手大坑:爬取数据的时候一定要设置header伪装成浏览器!!!! 在爬取某财经网站数据时由于没有设置Header信息,直接被封掉了ip 后来设置了Accept.Connection.User-A ...
scrapy爬取数据的基本流程及url地址拼接
说明:初学者,整理后方便能及时完善,冗余之处请多提建议,感谢! 了解内容: Scrapy :抓取数据的爬虫框架异步与非阻塞的区别异步:指的是整个过程,中间如果是非阻塞的,那就是异步 ...

随机推荐

java 基本语法（十一）数组（四）数组的常见算法
1.数组的创建与元素赋值: 杨辉三角(二维数组).回形数(二维数组).6个数,1-30之间随机生成且不重复. 杨辉三角 public class YHSJ { public static void m ...
javascript基础（三）：操作DOM对象（重点）
DOM:文档对象模型核心浏览器网页就是一个Dom树形结构! 更新:更新Dom节点遍历Dom节点:得到Dom节点删除:删除一个Dom节点添加:添加一个新的节点要操作一个Dom节点,就必须要先 ...
Django之 Models组件
本节内容路由系统 models模型 admin views视图 template模板引子讲django的models之前, 先来想一想, 让你通过django操作数据库,你怎么做? 做苦思冥想, ...
kafka 监控工具 eagle 的安装(内附高速下载地址)
简介如图 kafka eagle 是可视化的 kafka 监视系统,用于监控 kafka 集群环境准备: 需要的内存:1.5G+ 支持的 kafka 版本:0.8.2.x,0.9.x,0.10.x ...
3dTiles 数据规范详解[4.2] i3dm瓦片二进制数据文件结构
i3dm,即 Instanced 3D Model,实例三维模型的意思. 诸如树木.路灯.路边的垃圾桶.长椅等具有明显重复特征的数据.这类数据用得较少(笑,现在都喜欢搞BIM.倾斜摄影.精模.白模 ...
Spring的学习与实战(续)
@ 目录背景 JavaMailSender Spring集成邮件发送功能 1. 添加maven依赖 2. 添加Spring邮件配置 3. 创建邮件管理Bean并注入Spring应用上下文 4. 修改 ...
REACT——虚拟DOM
深入了解虚拟DOM 实际顺序 jsx->createElemnt ->虚拟DOM(JS 对象)->真实DOM 虚拟DOM中的Diff算法 :当react查找差异的时候,就会采用dif ...
bzoj3436小K的农场
bzoj3436小K的农场题意: n个数,知道m条关系:a-b≥c.a-b≤c或a==b.问是否存在满足所有关系的情况.n≤10000,m≤10000. 题解: 差分约束.因为只要求是否满足,因此最 ...
OSCP Learning Notes - Exploit(1)
Gaining Root with Metasploit Platform: Kali Linux, Kioptrix Level 1 1. Find the IP of Kioptirx nmap ...
Dresdon简介
很久没有写文章了.这几年经历了很多事情:离开VMware的不舍,拿到融资的开心,重回VMware的亲切,以及不再争强好胜,只做自己喜欢事情的平和. 可以说,我是幸运的:我这一辈子都在选择,而不是被迫接 ...

Ubuntu定时执行任务（定时爬取数据）

0|1corntab详细说明

Ubuntu定时执行任务（定时爬取数据）的更多相关文章

随机推荐

热门专题