scrapyd+gerapy的项目部署:

简单学习,后续跟进完善

声明:

   1)仅作为个人学习,如有冒犯,告知速删!
   2)不想误导,如有错误,不吝指教!

环境配置:

scrapyd下载:

  pip install scrapyd -i https://pypi.com/simple

scrapyd部署:

  scrapyd-deploy -p 项目名

注意:需要切换到项目的根目录下运行

scrapyd遇到的问题:

  1. 'scrapyd-deploy' 不是内部或外部命令,也不是可运行的程序,

  2. 解决方法:

    1. 找到scrapyd-deploy文件(Scripts文件夹下),这里每个人配置的pip安装路径不同 ;

    2. 然后在这个文件夹内创建两个文件,scrapy.bat 和 scrapyd-deploy.bat (新建 txt 文本文档,然后更改后缀名为 .bat)

    3. 编辑scrapyd-deloy.bat:

       @echo off
       #python.exe路径 scrapyd-deploy路径
       C:\Users\Administrator\AppData\Local\Programs\Python\Python37\python.exe    C:\Users\Administrator\AppData\Local\Programs\Python\Python37\Scripts\scrapyd-deploy %*
       ​
    4. scrapy.bat编辑:

       @echo off
       #python.exe路径 scrapyd路径
       C:\Users\Administrator\AppData\Local\Programs\Python\Python37\python.exe C:\Users\Administrator\AppData\Local\Programs\Python\Python37\Scripts\scrapyd %*

      注意:上面路径没有分行,两个路径之间有空格!

    5. 保存,新起cmd,运行scrapyd-deploy -h,出现以下信息即成功:

        Usage: scrapyd-deploy [options] [ [target] | -l | -L <target> ]

      Deploy Scrapy project to Scrapyd server

      Options:
      -h, --help show this help message and exit
      -p PROJECT, --project=PROJECT
      the project name in the target
      -v VERSION, --version=VERSION
      the version to deploy. Defaults to current timestamp
      -l, --list-targets list available targets
      -a, --deploy-all-targets
      deploy all targets
      -d, --debug debug mode (do not remove build dir)
      -L TARGET, --list-projects=TARGET
      list available projects on TARGET
      --egg=FILE use the given egg, instead of building it
      --build-egg=FILE only build the egg, don't deploy it
  3. 运行部署命令后报错:

      C:\Users\Administrator\PycharmProjects\code\xbhog>scrapyd-deploy -p xbhog
    Packing version 1595062659
    Deploying to project "xbhog" in http://localhost:6800/addversion.json
    Deploy failed: <urlopen error [WinError 10061] 由于目标计算机积极拒绝,无法连接。>
    C:\Users\Administrator\AppData\Local\Programs\Python\Python37\python.exe: can't open file 'C:\Users\Administrator\AppData\Local\Programs\Python\Python37\Scripts\scrapyd': [Errno 2] No such file or directory
  4. 解决方法:

    1. 先在一个cmd窗口执行scrapyd

    2. 然后再用另一个cmd窗口部署项目

gerapy安装以及使用:

  pip install gerapy -i https://pypi.com/simple
使用:
  • 1.在本地创建空文件夹

  • 2.进入文件夹,建立项目(gerapy init)

  • 3.进入生成的gerapy文件中

  • 4.对数据库进行初始化(gerapy migrate)

  • 5.创建超级管理员(gerapy initadmin)---账号密码:admin

  • 6.运行:gerapy runserver

scrapyd+gerapy搭配使用的效果图:

scrapyd+gerapy的项目部署的更多相关文章

  1. Scrapyd+Gerapy部署Scrapy爬虫进行可视化管理

    Scrapy是一个流行的爬虫框架,利用Scrapyd,可以将其部署在远程服务端运行,并通过命令对爬虫进行管理,而Gerapy为我们提供了精美的UI,可以在web页面上直接点击操作,管理部署在scrap ...

  2. 爬虫部署 --- scrapyd部署爬虫 + Gerapy 管理界面 scrapyd+gerapy部署流程

    ---------scrapyd部署爬虫---------------1.编写爬虫2.部署环境pip install scrapyd pip install scrapyd-client 启动scra ...

  3. scrapy抓取拉勾网职位信息(八)——使用scrapyd对爬虫进行部署

    上篇我们实现了分布式爬取,本篇来说下爬虫的部署. 分析:我们上节实现的分布式爬虫,需要把爬虫打包,上传到每个远程主机,然后解压后执行爬虫程序.这样做运行爬虫也可以,只不过如果以后爬虫有修改,需要重新修 ...

  4. jsp项目部署

    每新建一个项目都要发布到服务器,也就是项目部署,在tomcat中的  tomcat\Tomcat 6.0\webapps  路径下就会新建你的项目文件夹 webapps是tomcat的默认访问路径,很 ...

  5. javaWeb项目部署到阿里云服务器步骤

    记录web项目部署到阿里云服务器步骤 (使用 web项目.阿里云服务器.Xftp.Xshell),敬请参考和指正 1.将要部署的项目打包成WAR文件格式,可以在MyEclipse.Eclipse都可以 ...

  6. Spring+SpringMvc+Mybatis框架集成搭建教程四(项目部署及测试)

    在IDEA中将项目部署到本地Tomcat下进行运行并验证整合结果 (1).点击如下图所示的下拉按钮,弹出Edit Configurations...后点击该项. (2).跳出如下界面后,点击红框内的& ...

  7. SSIS2012 项目部署模型

    SSIS 2012 支持两种部署模型:项目部署模型和包部署模型. 使用项目部署模型可以将项目部署到 Integration Services 服务器,使用包部署模型可以将单独的包部署到Integrat ...

  8. 项目部署到tomcat Root中后导致 WebApplicationContext 初始化两次的解决方法

    上一篇文章刚说项目部署到tomcat的ROOT中,今天就发现一个问题.通过eclipse启动tomcat时候,WebApplicationContext 初始化两次: 现象:   通过eclipse控 ...

  9. 百度BAE JAVA环境项目部署和调试

    起初在一个应用挂在虚拟主机上,昨天早上虚拟主机挂了.本来考虑迁移到SAE上的,但之前发现SAE的JVM云豆消耗的太快(PS:我是中级开发者,每月 10000云豆,如果有哪位大神对SAE JAVA云豆能 ...

随机推荐

  1. Linux工具之开发调试命令

    目录 gcc gdb vim pmap pstack strace readelf objdump ldd gcc 详见 gcc -E 只预处理 gcc -S 生成汇编代码 gcc -c 生成可重定向 ...

  2. Maven全局配置文件settings.xml详解(转)

    Maven全局配置文件settings.xml详解   目录 一.概要 1.settings.xml的作用2.settings.xml文件位置3.配置的优先级 二.settings.xml元素详解 1 ...

  3. es性能调优---写优化操作

    ES 的默认配置,是综合了数据可靠性.写入速度.搜索实时性等因素.实际使用时,我们需要根据公司要求,进行偏向性的优化. 写优化 假设我们的应用场景要求是,每秒 300 万的写入速度,每条 500 字节 ...

  4. java web20套项目

    http://shenghuo.lshou.com/c4154/t5bdbcc98b9a9.html

  5. Python实用笔记 (25)面向对象高级编程——多重继承

    class Dog(Mammal, Runnable): pass 多重继承,继承了不同大类的所有功能,这种设计称之为Mixln,其目的就是给一个类增加多个功能,这样,在设计类的时候,我们优先考虑通过 ...

  6. 【数据库内核】RocksDB:事务锁设计与实现

    本文主要介绍 RocksDB 锁结构设计.加锁解锁过程,并与 InnoDB 锁实现做一个简单对比. 本文由作者授权发布,未经许可,请勿转载. 作者:王刚,网易杭研数据库内核开发工程师 MyRocks ...

  7. windows挂载nas存储

    操作系统:windows server 2016 1.安装nfs客户端打开程序面板 2.点击下一步 3.点击下一步 4.下一步 5.这里只选择文件和存储服务器就可以 6.选择nfs客户端,安装 7.m ...

  8. Linux中more和less的区别

    more的源码量大约2000行: less的源码量大约27000行: more历史比less久: less功能比more多: 其实本质没啥太大区别,都是为了查看文件方便. (完)

  9. 阐述Fetch.ai的能源市场优化

    原文链接:https://fetch.ai/explaining-fetch-ais-energy-market-optimization/ 阐述Fetch.ai的能源市场优化 2019年11月4日 ...

  10. python读取EXCEL是去掉空白行和表头全部重命名

    当读取进来的表格如图所示,转换成图2. import pandas as pd # header:指定作为列名的行,默认0,即取第一行的值为列名.数据为列名行以下的数据:若数据不含列名, # 则设定 ...