requests 获取百度推广信息

2019年的第一篇博客，恩，好久没写过博客了，恩，忘了，哈哈，实在是太懒了

今天写一个爬取百度推广数据的爬虫，当然我写的肯定不是那么的完美，但是能用，大哭

注意：有的时候，get或post方法获取数据是会报ssl等错误，网站要验证啥的，没搞懂，网上搜索，都是设置 verify=False，我也懒得去详细分析，你们要是有兴趣可以去了解一下，然后这么设置了，在GET或者post是会有warning提示，编写代码：

# 禁用ssl发出的警告
requests.packages.urllib3.disable_warnings()

下面代码：

def main():
　　#开启一个session对话
   main_session = requests.session()
   return main_session

def get_cost_info(main_session, endtime, flag1, flag2):
　　#获取省或市在日期或者月份下的消费信息
   if flag1 == 'province':
      splitDimension = "provinceName"
   else:
      splitDimension = "provinceCityName"
   if flag2 == 'month':
      unitOfTime = 3
   else:
      unitOfTime = 5
   headers = {
      'Accept':'application/json',
      'Accept-Encoding':'gzip, deflate',
      'Accept-Language':'zh-CN,zh;q=0.8',
      'Connection':'keep-alive',
      'Content-Length':'763',
      'Content-Type':'application/x-www-form-urlencoded',
      'Cookie':setting.Cookie,
      'DNT':'1',
      'Host':'fengchao.baidu.com',
      'Origin':'https://fengchao.baidu.com',
      'Referer':'https://fengchao.baidu.com/fc/report/dashboard/user/%s/account'%setting.userid,
      'User-Agent':'Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/47.0.2526.106 BIDUBrowser/8.7 Safari/537.36',
      'X-DevTools-Emulate-Network-Conditions-Client-Id':'87F3C66D-3166-46F6-8B46-141057354EBC'
   }
   params = {
      "userId":setting.userid,
      "ids":[setting.userid],
      "idType":2,
      "splitDimension":splitDimension,
      "limit":[0,1000],
      "sortRules":[],
      "levelOfDetails":211,
      "startDate":"2019-01-01",
      "endDate":endtime,
      "predicateConditions":[],
      "unitOfTime":unitOfTime,
      "columns":["userId","date","accountName","impression","click","cost","cpc","ctr","conversion","phoneConversion","bridgeConversion"]
   }
   formdata = {
      'reqid': setting.reqid,
      'eventId': setting.eventId,
      'userid': setting.userid,
      'token': setting.token,
      'path': 'mars/GET/AccountReportDataService/getAccountDataCenterReportData',
      'params': json.dumps(params)
   }
　　#url是去F12---network获取的
   url_1 = 'https://fengchao.baidu.com/hairuo/request.ajax?path=mars/GET/AccountReportDataService/getAccountDataCenterReportData&reqid=%s' % formdata['reqid']
   cont_1 = main_session.post(url_1, headers=headers, data=formdata, verify=False)
   datas = cont_1.json()
   cont_list_1 = datas['data']['ACCOUNT']['rows']
   for i in cont_list_1:
      cont_list_2 = i['subRows']
      cont_list = []
      for j in cont_list_2:
         if flag2 == 'month':
            time_1 = j['date'][0:7]
            time_list1 = time_1.split('-')
            date = '%s年%s月份' % (time_list1[0], str(int(time_list1[1])))
         else:
            date = j['date']
         zhanghu = j['accountName']
         province, city = '', ''
         if flag1 == 'province':
            province = j['provinceName']
         else:
            city_list = j['provinceCityName'].split('-')
            province, city = city_list[0], city_list[1]
         zhanxian = str(j['impression'])
         dianji = str(j['click'])
         xiaofei = str(j['cost'])
         pinjunjiage = str('%.2f' % (j['cpc']))
         dianjilv = str('{:.2%}'.format(j['ctr']))
         wangyezhuanhua = str(j['conversion'])
         dianhuazhuanhua = str(j['phoneConversion'])
         shangqiaozhuanhua = str(j['bridgeConversion'])
cont_list.append([date, zhanghu, province, zhanxian, dianji, xiaofei, pinjunjiage, dianjilv, wangyezhuanhua, dianhuazhuanhua, shangqiaozhuanhua])

经过测试，cookie一般能保持7天不过期，七天之后就要重新登录浏览器F12获取

requests 获取百度推广信息的更多相关文章

ionic基于GPS定位并通过百度地图获取定位详细信息
相信所有的前端攻城狮都会碰到移动端App.里面获取用户定位信息. 那么问题来了,怎么获取用户的定位信息(经纬度)呢. 当然方法有很多,通过百度地图API 以及高德地图 API都是可以的.但是两个获取 ...
python3爬虫-通过requests获取安居客房屋信息
import requests from fake_useragent import UserAgent from lxml import etree from http import cookiej ...
Python获取百度浏览记录
Python模拟百度登录实例详解 http://www.jb51.net/article/78406.htm Python实战计划学习作业2-1 http://blog.csdn.net/python ...
[Python爬虫] Selenium+Phantomjs动态获取CSDN下载资源信息和评论
前面几篇文章介绍了Selenium.PhantomJS的基础知识及安装过程,这篇文章是一篇应用.通过Selenium调用Phantomjs获取CSDN下载资源的信息,最重要的是动态获取资源的评论,它是 ...
【ASP.NET 进阶】获取MP3文件信息并显示专辑图片
突发奇想,想弄个显示MP3文件信息和专辑图片的小Demo,个人不是大牛,遂百度之,总算搞定,现分享如下. 效果图: GIF效果图: 主要是依靠2个DLL文件:ID3.dll 和 Interop.She ...
在Android Studio中使用BaiduMap SDK实时获取当地位置信息
配置BaiduMap 环境 1.在百度API中新建自己的一个APP包名和APP名需要注意和自己Android Studio 中的包名和APP名保持一致: 2.百度地图中还需要填写一个SHA1 数字签名 ...
获取百度地图POI数据三（模拟关键词搜索）
上一篇博文中讲到如何获取用于搜索的关键词,并且已经准备好了一百五十万的关键词这其中有门牌号码,餐馆酒店名称,公司名称,道路名称等.有了这些数据,我们就可以通过代码,模拟我们在百度地图的搜索框中搜 ...
获取百度地图POI数据二（准备搜索关键词）
上篇讲到想要获取尽可能多的POI数据需要准备尽可能多的搜索关键字那么这些关键字如何得来呢? 本人使用的方法是通过一些网站来获取这些关键词 http://poi.mapbar.com ...
requests获取所有状态码
requests获取所有状态码 requests默认是不会获取301/302的状态码的.可以设置allow_redirects=False,这样就可以获取所有的状态码了 import requests ...

随机推荐

在react-native项目中使用iconfont自定义图标库(android)
1. 安装react-native-vector-icons yarn add react-native-vector-icons react-native link 如果没有关联成功的话,可以参考官 ...
Hbase命令
进入hbase shell命令行 bin/hbase shell HBase Shell; enter 'help' for list of supported commands. Type &quo ...
react + axios实践
本文只要介绍如何在项目中把react和axios结合起来使用,想了解更多关于axios详细知识以及api,可以到官网查看 https://www.npmjs.com/package/axios 首先安 ...
洛谷.5283.[十二省联考2019]异或粽子(可持久化Trie 堆)
LOJ 洛谷考场上都拍上了,8:50才发现我读错了题=-= 两天都读错题...醉惹... \(Solution1\) 先求一遍前缀异或和. 假设左端点是\(i\),那么我们要在\([i,n]\)中找 ...
DWM1000 测距原理简单分析之 SS-TWR代码分析1 -- [蓝点无限]
蓝点DWM1000 模块已经打样测试完毕,有兴趣的可以申请购买了,更多信息参见蓝点论坛正文: 这一篇内容主要是通过官方源码理解SS-TWR 细节代码下载链接:https://download.c ...
LeetCode第二题
题目描述: You are given two non-empty linked lists representing two non-negative integers. The digits ar ...
iniReader,读取配置文件中数据
#include ”IniOperation.h" CString strPath = strIntancePath + _T("..\\config.ini"); // ...
解决国内NPM安装依赖速度慢问题
版权声明:本文为博主原创文章,转载请注明原文地址. http://blog.csdn.net/rongbo_j/article/details/52106580 不知道各位是否遇到这种情况,使用N ...
Assembly.LoadFrom加载程序集无法释放资源的解决方案
下面此方法加载程序集会导致程序集一直被占用 Assembly asm = Assembly.LoadFrom(dllPath); 解决方案: //通过此方法读取可以解决dll被占用问题 byte[] ...
js图片预加载与延迟加载
图片预加载的机制原理:就是提前加载出图片来,给前端的服务器有一定的压力. 图片延迟加载的原理:为了缓解前端服务器的压力,延缓加载图片,符合条件的时候再加载图片,当然不符合的条件就不加载图片. 预加载 ...

requests 获取百度推广信息

requests 获取百度推广信息的更多相关文章

随机推荐

热门专题