35.百度云语音识别接口使用及PyAudio语音识别模块安装
百度云语音识别接口使用:
百度云语音识别接口文档:https://cloud.baidu.com/doc/SPEECH/ASR-API.html#JSON.E6.96.B9.E5.BC.8F.E4.B8.8A.E4.BC.A0
一. 解析用户语音输入,转换为字符串
- 捕获用户的语音输入
- windows安装
- pip3 install PyAudio #如果报错可以尝试2,3步骤 丶 如果用pip3下载安装报错可以在python第三方安装包下载地址搜索下载安装https://pypi.org/
- python -m pip install --upgrade pip
- pip install PyAudio
CentOS 7.4 下安装PyAudio 需要先安装 portaudio (采用的方法,可行)
1、在安装pyaudio时,报错failed error: portaudio.h: 没有那个文件或目录
2、pyaudio的运行需要依赖于portaudio这个库,应该先安装一个portaudio库
3、portaudio安装步骤:
a)下载portaudio库http://portaudio.com/download.html
b)将下载的文件进行解压
c)进入解压后的portaudio文件,依次执行命令:
./configure
make
make install
d)进入~/.bashrc文件:vim ~/.bashrc
在文件最后一行加入 export LD_LIBRARY_PATH=$LD_LIBRARY_PATH:/usr/local/lib
然后执行命令source ~/.bashrc
4、到此portaudio库安装成功
5、安装pyaudio库,pip3 install pyaudio (wget https://files.pythonhosted.org/packages/ab/42/b4f04721c5c5bfc196ce156b3c768998ef8c0ae3654ed29ea5020c749a6b/PyAudio-0.2.11.tar.gz)
成功后显示版本为0.2.11
二,音频数据给到百度云
- 音频数据的格式规则
- format:格式 wav
- rate:采样率 16000
- channel:声道 1单声道
- cuid:用户ID MAC地址,只要保证唯一
- token:身份识别 在百度云接口平台注册后,才能拿到
- dev_pid: 1536英文,1537中文
- len:数据的长度 原始的 len(data) ->
- speech:数据对象
1,base64 编码2,经常用于网络中的音频图像二进制的数据传输3,base64.b64encode(data)
- **JSON**格式POST上传本地音频流数据
- header:Content-Type:application/json
- 标识,
- GET:直接获取服务器上的数据
- POST:客户端先向服务端提交数据,服务端在返回,POST一定会向服务器提交数据
- RESTFUL:资源定义成了连接(url 同一资源,这个要了解一下)
- 连接,www.baidu.com
- POST提交数据,
- WEB服务 HTTP协议
- RESTFUL:ip/?shutdown #关机命令
- http://vop.baidu.com/server_api #百度云api接口地址,我们的语音信息提交到这个接口就行了
三,捕获百度云返回的结果
- JSON的返回 #无论什么方式上传都会以JSON格式返回结果
- json.loads() 解析json数据变为Python中数据对象 字典
- j'son.dumps() dict -> dict
- result #音频返回的结果在result字段中
- PyAudio:对象,实例化一个设备
- pa.open(format=存储位深 int 16位, channels=声道,rate=采样率,input=True,frame_per_buffer=1024)
import time
from pyaudio import PyAudio,paInt16
from urllib.request import urlopen,Request #专门处理http协议的模块
import json
import base64
def play_audio(data): #播放音频
pa = PyAudio() #设备实例化
equip = pa.open(
format=paInt16,
channels=1, #单声道
rate=16000,
output=True,
) #打开设备,并且支持输出
equip.write(data) #设备的write函数,写入音频数据
equip.stop_stream() #关闭写入
equip.close()
pa.terminate() #关闭设备实例
def record_audio(): #输入音频
pa = PyAudio() #设备实例化
equip = pa.open(
format=paInt16,
channels=1,
rate=16000,
input=True,
frames_per_buffer=1024,
) #打开设备,并且支持输入
data = [] #存储未来的语音输入
#一截一截的语音数据 [b'1',b'2',]
times = 0 #用来控制用户输入语音长度的
start = time.time()
while times < 50: #3S
data.append(equip.read(1024)) #读取设备中此时的语音数据
times += 1
end = time.time()
print('[TALK] %.2f' % (end - start)) #%.2f 保留2位小数点有效位数字
data = b''.join(data) #完整的音频流数据
equip.close()
pa.terminate() #关闭设备实例
return data
def baidu_token():
API_Key = 'oAcBP47GDDpj6XIHWmcSkeRi'
Secret_Key = 'ba2EKROswCy6KXzLdTpnGqPnPhHSFHU7'
grant_type = 'client_credentials'
url = 'https://aip.baidubce.com/oauth/2.0/token?grant_type=%s&client_id=%s&client_secret=%s'
response = json.loads(urlopen(url % (grant_type,API_Key,Secret_Key)).read().decode())
access_token = response['access_token']
return access_token
def baidu_fenxi(data):
url = 'http://vop.baidu.com/server_api'
data_len = len(data)
audio_data = base64.b64encode(data).decode()
access_token = baidu_token()
post_data = json.dumps({
"format":"wav",
"rate":16000,
"dev_pid":1536,
"channel":1,
"token":access_token,
"cuid":"00-50-56-C0-00-08",
"len":data_len,
"speech":audio_data,
}).encode() #变为json的二进制
headers = {'Content-Type':'application/json'}
req = Request(url=url,headers=headers,data=post_data)
result = json.loads(urlopen(req).read().decode()).get('result')
if result:
return result[0]
else:
return None
def main():
data = record_audio()
res = baidu_fenxi(data)
print(res)
if __name__ == '__main__':
#程序入口
main()运行结果:E:\python学习资料\上课代码编写\代码练习py>python e:/python学习资料/上课代码编写/代码练习py/百度云.py
[TALK] 3.21
你好
35.百度云语音识别接口使用及PyAudio语音识别模块安装的更多相关文章
- C#调用百度云存储接口上传文件
因前几日见园子里有人说可以把网站静态文件放在百度上,于是去百度开放平台看了看,发现之前那篇文章不是调的云存储接口啊... 于是自己写了个C#能调百度云存储的例子(百度云开放平台只提供php.java. ...
- 百度云服务接口错误:Parameter invalid, the key input with filter parameter is not searchfilter column key
百度LBS云服务接口: 地址:http://lbsyun.baidu.com/index.php?title=lbscloud/api/geosearch 访问接口:http://api.map.ba ...
- 借助百度云API进行人脸识别
前言:本篇博客是笔者第一次使用百度云api进行人脸检测,主要内容包括两部分,一是获取接口,二是借助接口进行人脸检测.笔者也是初步了解这方面的内容,也是参考了杂七杂八的博文,内容可能存在错误及其他毛病, ...
- 百度云语音识别,Audio2Txt(c#)
百度云识别没有提供c#版本的sdk,下面给个c#的 1.打开网址http://developer.baidu.com/ 2.登陆 3.管理控制台>开发者服务管理 4.创建工程 5.输入名称,点击 ...
- python录音并调用百度语音识别接口
#!/usr/bin/env python import requests import json import base64 import pyaudio import wave import os ...
- python调用百度语音识别接口实时识别
1.本文直接上干货 奉献代码:https://github.com/wuzaipei/audio_discern/tree/master/%E8%AF%AD%E9%9F%B3%E8%AF%86%E5% ...
- 利用百度云接口实现车牌识别·python
一个小需求---实现车牌识别. 目前有两个想法 1. 调云在线的接口或者使用SDK做开发(配置环境和变异第三方库麻烦,当然使用python可以避免这些问题) 2. 自己实现车牌识别算法(复杂) 一开始 ...
- python利用百度云接口实现车牌识别
一个小需求---实现车牌识别. 目前有两个想法 调云在线的接口或者使用SDK做开发(配置环境和编译第三方库很麻烦,当然使用python可以避免这些问题) 自己实现车牌识别算法(复杂) ! 一开始准备使 ...
- Android推送服务——百度云推送
一.推送服务简介 消息推送,顾名思义,是由一方主动发起,而另一方与发起方以某一种方式建立连接并接收消息.在Android开发中,这里的发起方我们把它叫做推送服务器(Push Server),接收方叫做 ...
随机推荐
- Sort Letters by Case
Given a string which contains only letters. Sort it by lower case first and upper case second. Examp ...
- 9、组件注册-@Import-使用ImportSelector
9.组件注册-@Import-使用ImportSelector 9.1 @Import 源码: @Target(ElementType.TYPE) @Retention(RetentionPolicy ...
- 006_linuxC++之_引用
1. 什么是“引用”?申明和使用“引用”要注意哪些问题? 答:引用就是某个目标变量的“别名”(alias),对应用的操作与对变量直接操作效果完全相同.申明一个引用的时候,切记要对其进行初始化.引用声明 ...
- 下载文件设置header的filename要用ISO8859-1编码的原因
很多情况下,我们在写程序的时候都会把代码设置为UTF-8的编码,可以在下载文件设置filename的时候却有违常理,竟然设置编码格式为ISO8859-1,代码如下(如是英文的话就不需要这样处理了): ...
- C++编译错误--C++连接redis:编译错误error C2371: “off_t”: 重定义;不同的基类型
编译错误:对于编译C++调用hiredis编译错误:error C2371: “off_t”: 重定义:不同的基类型,如下图: 可能的解决方案: 1. 因为hiredis预处理器定义了_OFF_T_D ...
- 【原创】go语言学习(一)
一.go发展历史 1.1诞生历史 1.诞生于2006年1月下午15点4分5秒 2.2009发布并正式开园 3.2012年第一个正式版本Go1.0发布 4.截止2019年10月8日,Go1.13.1 1 ...
- Web开发入门教程:Pycharm轻松创建Flask项目
Web开发入门教程:Pycharm轻松创建Flask项目 打开Pycharm的file,选择创建新的项目,然后弹出对话框,我们可以看到里面有很多的案例,Flask.Django等等,我们选择生成Fla ...
- 一个list<Map>里map其中的一个字段的值相同,如何判断这个字段相同,就把这个map的其他字段存入另一个map中
//不建议使用Map保存这些,使用实体bean更好 package com.rxlamo.zhidao; import java.util.*; public class Main { ...
- windows下使用curl命令&&常用curl命令
什么是curl命令? curl是利用URL语法在命令行方式下工作的开源文件传输工具.它被广泛应用在Unix.多种Linux发行版中,并且有DOS和Win32.Win64下的移植版本. 如何在windo ...
- QtCreator集成的MSVC套件有问题
MSVC编译出来的内部签名算法的程序,相同的代码,验签结果和MINGW编译出来的不一样.MINGW编译出来的结果是正确的 怀疑是因为QtCreator集成的msvc有问题,可能是编码问题,可能是其他问 ...