python_selenium智联搜索

去招聘会工作，奈何网上仅仅提供招聘会的公司名字，没有提供招聘的职位，SO我写了个小代码给别人在智联上面搜索职位，由于时间紧迫，前程的就不写了

#!/usr/bin/python3.4

# -*- coding: utf-8 -*-

from selenium import webdriver

from lxml import etree

import time

# 打开浏览器

def openbrowser(keyword):

    global browser

    # 打开谷歌浏览器

    # Firefox()

    # Chrome()

    # browser = webdriver.Chrome()

    options = webdriver.ChromeOptions()

    prefs = {

        'profile.default_content_setting_values': {

            'images': 2

        }

    }

    options.add_experimental_option('prefs', prefs)

    browser = webdriver.Chrome(chrome_options=options)

    try:

        browser.find_element_by_id("KeyWord_kw2").send_keys(keyword)

        browser.find_element_by_class_name("doSearch").click()

        time.sleep(5)

        htmlcontent = browser.page_source

        browser.quit()

    except:

        url = "http://www.zhaopin.com/"

        browser.get(url)

        # 打开浏览器时间

        # print("等待10秒打开浏览器...")

        # time.sleep(10)

        browser.find_element_by_id("KeyWord_kw2").send_keys(keyword)

        browser.find_element_by_class_name("doSearch").click()

        time.sleep(5)

        htmlcontent = browser.page_source

        browser.quit()

    return htmlcontent

def analyzehtml(html):

    info = []

    page = etree.HTML(html.lower())

    hrefs = page.xpath('//a[@style="font-weight: bold"]/text()')

    for href in hrefs:

        info.append(href)

    return info

if __name__ == "__main__":

    file = open("../txt/company.txt")

    companys = file.readlines()

    for keyword in companys:

        print(keyword.strip())

        html = openbrowser(keyword.strip())

        a = analyzehtml(html)

        a.insert(0, str(keyword.strip()))

        print(a)

        b = "&&".join(a)

        if len(b)==0:

            b = "智联没有找到该公司"

        filewrite = open("../txt/qwe.txt", "a")

        filewrite.write("\n" + str(b))

        filewrite.close()

python_selenium智联搜索的更多相关文章

用python抓取智联招聘信息并存入excel
用python抓取智联招聘信息并存入excel tags:python 智联招聘导出excel 引言:前一阵子是人们俗称的金三银四,跳槽的小朋友很多,我觉得每个人都应该给自己做一下规划,根据自己的进步 ...
python爬虫实战（五）--------智联招聘网
前些天帮同事爬取一些智联招聘网上的关于数据分析的职位信息,他说要做一些数据分析看看,现在已经帮他爬完了.我本来想用Scrapy来爬的,但是不知道为什么爬取的数据和真实搜到的数据不太一样,比如:搜索到的 ...
Python+selenium爬取智联招聘的职位信息
整个爬虫是基于selenium和Python来运行的,运行需要的包 mysql,matplotlib,selenium 需要安装selenium火狐浏览器驱动,百度的搜寻. 整个爬虫是模块化组织的,不 ...
Java实例——基于jsoup的简单爬虫实现（从智联获取工作信息）
这几天在学习Java解析xml,突然想到Dom能不能解析html,结果试了半天行不通,然后就去查了一些资料,发现很多人都在用Jsoup解析html文件,然后研究了一下,写了一个简单的实例,感觉还有很多 ...
python爬取智联招聘职位信息（单进程）
我们先通过百度搜索智联招聘,进入智联招聘官网,一看,傻眼了,需要登录才能查看招聘信息没办法,用账号登录进去,登录后的网页如下: 输入职位名称点击搜索,显示如下网页: 把这个URL:https://s ...
异构智联Wi-Fi+蓝牙模组，连接快、准、稳！
下班回家打开门,电灯.电视.空调.音响.电动窗帘.扫地机器人--一呼百应,有序开工,原本冰冷的房子立刻变成了温暖港湾.可以说,舒适便捷的智能设备已经完全融入了我们的生活中. 从单一场景.单一设备,到现 ...
智联招聘卓聘IM演进过程
1. 卓聘IM开发背景智联卓聘是智联旗下高端人才招聘平台,成立快4年了,业务增涨每年以100%速度增涨,业务增涨快在开发和上线速度要求也比较高. 2016年6月提出IM开发需求,7月初上线,开发人 ...
智联卓聘卓聘IM(聊聊)开发实践
1. 卓聘IM开发背景智联卓聘是智联旗下高端人才招聘平台,成立快4年多,业务增涨每年以100%速度增涨快,同时对产品和研发速度都比较高. 2015年提出IM开发,主要用于后选人与猎头及时交流,降低 ...
node.js 89行爬虫爬取智联招聘信息
写在前面的话, .......写个P,直接上效果图.附上源码地址 github/lonhon ok,正文开始,先列出用到的和require的东西: node.js,这个是必须的 request,然发 ...

随机推荐

mySQL基本操作学习笔记（一）
...
Fragment的使用（二）
动态添加Fragment 将MainActivity的布局文件中的两个Fragment的代码注释掉.在MainActivity的java文件中添加如下代码: package com.cm.myfrag ...
jdk安装及环境变量配置
JDK是 Java 语言的软件开发工具包,主要用于移动设备.嵌入式设备上的java应用程序.JDK是整个java开发的核心,它包含了JAVA的运行环境,JAVA工具和JAVA基础的类库. jdk下载地 ...
Spring事务配置的五种方式（转载）
Spring配置文件中关于事务配置总是由三个组成部分,分别是DataSource.TransactionManager和代理机制这三部分,无论哪种配置方式,一般变化的只是代理机制这部分. DataSo ...
Vue.js常用指令总结
有时候指令太多会造成记错.记混的问题,所以本文在记忆的时候会采用穿插记忆的方式,交叉比对,不易出错. 本文主要讲了一下六个指令: v-if//v-show//v-else//v-for//v-bind ...
将JavaScript 插入网页的方法
将JavaScript 插入网页的方法使用Javascript代码. 插入JavaScript 与在网页中插入CSS的方式相似.使用下面的代码可以在网页中插入JavaScript: ... 其中的. ...
面试题12:打印1到最大的n位数
// 面试题12_打印1到最大的n位数.cpp : 定义控制台应用程序的入口点. // #include "stdafx.h" #include <iostream> ...
第6章第一个Linux驱动程序：统计单词个数
编写一个Linux的一般步骤: 第1步:建立Linux驱动骨架(装载和卸载Linux驱动) 第2步:注册和注销设备文件第3步:指定和驱动相关的信息第4步:指定回调函数第5步:编写业务逻辑第6步 ...
GFW-新闭关锁国政策
当八国联军的炮火轰开古老的北京城门,不知道腐朽的清政府是否依旧认为闭关锁国政策是一项正确的国策?清政府实施闭关锁国政策基于2点考虑:1.安全,国家安全,不想让这些洋鬼子来捣乱.2.我天朝大国,根本无需 ...
softwareTesting_work2_question2
work2类 package com.Phantom; import java.util.Scanner; import javax.print.DocFlavor.INPUT_STREAM; pub ...

python_selenium智联搜索

python_selenium智联搜索

python_selenium智联搜索的更多相关文章

随机推荐

热门专题