背景

前端时间在喜马拉雅上偶然听到牛大宝说的有声小说神通板砖,说的很是幽默,听的正起劲的时候开始收费了,于是我就在网上找了下看看有没有免费版,一搜果然有,但该网站上广告太多了,于是我就写了个小脚本可以批量下载的,供大家学习,如果您使用该脚本用于任何非法用途,均与本站无关

思路

  1. 找到可以免费下载资源网站
  2. 针对该网站html进行分析并编写下载脚本
  3. linux命令行自动顺序播放

实施

找到可以免费下载资源网站

网址: www.ting56.com/mp3/6475.html#liebiao

编写脚本 stbz.py

#!/usr/bin/env python3
# -*- coding: utf-8 -*- from html.parser import HTMLParser
import urllib3
import os http = urllib3.PoolManager()
baseUrl='http://www.ting56.com' class Mp3HTMLParser(HTMLParser):
def __init__(self):
HTMLParser.__init__(self) def handle_starttag(self,tag,attrs):
if tag == 'div':
for (k,v) in attrs:
if k=='id' and v=='bofangqi':
print(tag) class MyHTMLParser(HTMLParser): def __init__(self):
self.a_t = False
HTMLParser.__init__(self) def handle_starttag(self, tag, attrs):
"""
recognize start tag, like <div>
:param tag:
:param attrs:
:return:
"""
if tag == 'div':
for (k,v) in attrs:
if k == 'id' and v == 'vlink_1':
self.a_t = True
#print("Encountered a start tag:", tag)
else:
self.a_t = False
if self.a_t:
if tag == 'a':
title = ''
url = ''
for (k,v) in attrs:
if k=='href':
url=baseUrl+v
if k=='title':
title=v
#print('%s %s \n' % (title,url))
download(title,url)
#r = http.request('GET',url)
#dataStr = r.data.decode('gbk')
#parser = Mp3HTMLParser()
#parser.feed(dataStr) # def handle_endtag(self, tag):
# """
# recognize end tag, like </div>
# :param tag:
# :return:
# """
# print("Encountered an end tag :", tag)
#
def handle_data(self, data):
"""
recognize data, html content string
:param data:
:return:
"""
pass
#if self.a_t:
#print(data)
#
# def handle_startendtag(self, tag, attrs):
# """
# recognize tag that without endtag, like <img />
# :param tag:
# :param attrs:
# :return:
# """
# print("Encountered startendtag :", tag)
#
# def handle_comment(self,data):
# """
#
# :param data:
# :return:
# """
# print("Encountered comment :", data) def fromCharCode(n):
return chr(n%256) def download(name,url):
print('%s%s' % (name,url))
cmd = 'echo "%s%s" >> /tmp/stbz/downloadList.txt' % (name,url)
os.system(cmd) try:
if int(name) <= 137:
return
r = http.request('GET',url)
dataStr = r.data.decode('gbk')
os.environ['htmlStr'] = dataStr
cmd = 'echo $htmlStr | sed "s/.*FonHen_JieMa(\([0-9\\\'\*]*\)).*/\\1/g"'
t = os.popen(cmd).read()
t = t[1:-2]
#print(t)
tArr = t.split('*')
tmp = ''
for s in tArr:
if len(s)==0:
continue
tmp = tmp + fromCharCode(int(s))
print(tmp)
datas = tmp.split('&')
print(datas)
cmd = 'curl %s --output /tmp/stbz/%s.%s' % (datas[0],name,datas[2])
if os.system(cmd) != 0:
raise Exception("download err")
except:
print('[err] %s%s ' % (name,url))
cmd = 'echo "%s%s" >> /tmp/stbz/err.txt' % (name,url)
os.system(cmd) if __name__ == "__main__":
os.system('echo "" > /tmp/stbz/downloadList.txt')
r = http.request('GET','http://www.ting56.com/mp3/6475.html#liebiao')
dataStr = r.data.decode('gbk')
#print(dataStr)
parser = MyHTMLParser()
parser.feed(dataStr)

自动播放脚本

下载好的音频文件都是以数字编号的,所以可以播放完一个自动进行下一个,并且记录当前播放记录,方便下次继续播放 将下面的脚本保存为play.sh

#!/usr/bin/env bash

basepath=$(cd `dirname $0`;pwd)
cd $basepath
echo "workspace [$basepath]" posfile="stbz.pos" if [ ! -f "$posfile" ]; then
echo '1.m4a' > ${posfile}
fi pos=$(cat ${posfile})
state="start" for name in `cat ./stbz.lst`;do
if [ $state = "start" ]; then
if [ $pos = $name ]; then
echo "begin play ${pos}"
mplayer $name 1>> /dev/null 2>>err.txt || exit 1
state="play"
echo "${name}" > ${posfile}
fi
else
echo "begin play ${name}"
echo "${name}" > ${posfile}
mplayer $name 1>> /dev/null 2>>err.txt || exit 1
fi
done


原文来自 https://www.h3blog.com/article/python-download-stbz/

python下载神通板砖有声版的更多相关文章

  1. python下载想听的有声书,让喜马拉雅收费,我是程序员!

    from urllib import parse,request import urllib header_dict = {'User-Agent': 'Mozilla/5.0 (Windows NT ...

  2. Python学习手册(第4版) - 专业程序员的养成完整版PDF免费下载_百度云盘

    Python学习手册(第4版) - 专业程序员的养成完整版PDF免费下载_百度云盘 提取码:g7v1 作者简介 作为全球Python培训界的领军人物,<Python学习手册:第4版>作者M ...

  3. Python基础教程(第3版)PDF高清完整版免费下载|百度云盘

    百度云盘:Python基础教程(第3版)PDF高清完整版免费下载 提取码:gkiy 内容简介 本书包括Python程序设计的方方面面:首先从Python的安装开始,随后介绍了Python的基础知识和基 ...

  4. Python学习手册(第4版)PDF高清完整版免费下载|百度云盘

    Python学习手册(第4版)PDF高清完整版免费下载|百度云盘 提取码:z6il 内容简介 Google和YouTube由于Python的高可适应性.易于维护以及适合于快速开发而采用它.如果你想要编 ...

  5. Python编程入门(第3版)|百度网盘免费下载|零基础入门学习资料

    百度网盘免费下载:Python编程入门(第3版) 提取码:rsd7 目录  · · · · · · 第1章 编程简介 11.1 Python语言 21.2 Python适合用于做什么 31.3 程序员 ...

  6. Python核心编程(第3版)PDF高清晰完整中文版|网盘链接附提取码下载|

    一.书籍简介<Python核心编程(第3版)>是经典畅销图书<Python核心编程(第二版)>的全新升级版本.<Python核心编程(第3版)>总共分为3部分.第1 ...

  7. Python下载及Python最强大IDEPyCharm下载链接

    Python下载: https://www.python.org/downloads/ PyCharm下载: https://www.jetbrains.com/pycharm/download/#s ...

  8. 学习参考《Python基础教程(第3版)》中文PDF+英文PDF+源代码

    python基础教程ed3: 基础知识 列表和元组 字符串 字典 流程控制 抽象(参数 作用域 递归) 异常 魔术方法/特性/迭代器 模块/标准库 文件 GUI DB 网络编程 测试 扩展python ...

  9. Python环境搭建-3 Python下载

    python环境搭建 Python是一个跨平台.可移植的编程语言,因此可在windows.Linux和Mac OS X系统中安装使用. 安装完成后,你会得到Python解释器环境,可以通过终端输入py ...

随机推荐

  1. Java注解基础

    0.背景 Java注解--Annotation产生于JDK5.作为code的特殊“标记”,注解可以在编译.类加载.运行时被读取,并执行处理. 开发利用注解在源码中嵌入补充信息,工具(代码分析.开发.部 ...

  2. Z变换解差分方程的思考

    问题描述 今日碰到一道差分方程的题目,如下 [ y(n + 2) - cfrac{7}{10}y(n + 1) + cfrac{1}{10}y(n) = 7x(n+2) -2 x(n + 1) ] 已 ...

  3. How Cocoa Beans Grow And Are Harvested Into Chocolate

    What is Cocoa Beans Do you like chocolate? Most people do. The smooth, brown candy is deliciously sw ...

  4. signal之——异步回收机制

    前言:回收子进程之前用了wait()和非阻塞模型,今天学了信号以后可以使回收机制更上一层楼,通过信号函数,父进程只需要做自己的事情,接收到信号后就触发信号函数. 信号处理函数可能会出现的bug: 1. ...

  5. 安装python第三方包

    20190822 先说一下,有4种方法(我知道的): 1.源码安装 2.python自带包管理器安装 3.外部包管理器安装 4.whl格式安装 1.源码安装 Python第三方库几乎都可以在githu ...

  6. 德国、日本的制造业为什么不能完全执行SOP?

    在过去几十年,德国.日本的制造企业简直就是"以质取胜"的代名词,一些制造业的CEO非常自豪,甚至在公开场合调侃:大家好,我就是"保质保量"本人,也正因如此,德国 ...

  7. Synchronized的jvm实现

    参考文档: https://www.cnblogs.com/dennyzhangdd/p/6734638.html

  8. jenkins邮件内容模板

    <!DOCTYPE html> <html> <head> <meta charset="UTF-8"> <title> ...

  9. IO流文件拷贝

    目录 IO流文件拷贝 前言 字节流(使用FileInputStream和FileOutputStream读取每一个字节...) 字节流(使用FileInputStream和FileOutputStre ...

  10. Nginx笔记总结十三:sub_filter内容替换

    Nginx变异安装加上参数 --with-http_sub_module 配置文件: location ~* ^/portalproxy/([-]*)/portal(.*)$ { #sub_filte ...