python +百度语音识别+图灵对话

https://github.com/Dongvdong/python_Smartvoice

上电后，只要周围声音超过 2000，开始录音5S
录音上传百度识别，并返回结果文字输出
继续等待，周围声音是否超过2000，没有就等待。
点用电脑API语音交互
、、

# -*- coding: utf-8 -*-

# 树莓派

from pyaudio import PyAudio, paInt16

import numpy as np

from datetime import datetime

import wave

import time

import requests#导入requests库

import urllib,  urllib.request, pycurl

import base64

import json

import os

import sys

from imp import reload

# 调用电脑API生成语音交互

import speech

import win32api

import os

import sys

import time

import win32con

reload(sys)

#sys.setdefaultencoding( "utf-8" )

#一些全局变量

save_count = 0

save_buffer = []

t = 0

sum = 0

time_flag = 0

flag_num = 0

filename = ''

duihua = '1'

def getHtml(url):

    html= requests.get(url)

   # html.encoding = 'utf-8'#防止中文乱码

    return html.text

def get_token():

    apiKey = "AxXDYEN27Ks9XHocsGmCEdPm"

    secretKey = "61cd52759f4d704d91c155a22ff7183d"

    auth_url = "https://openapi.baidu.com/oauth/2.0/token?grant_type=client_credentials&client_id=" + apiKey + "&client_secret=" + secretKey;

    res = requests.get(auth_url)

    #res.encoding = 'utf-8'#防止中文乱码

    #print (res.text)

    return json.loads(res.text)['access_token']

def dump_res(buf):#输出百度语音识别的结果

    global duihua

    #print ("字符串类型")

    #print (buf)

    a = eval(buf)

    #print (type(a))

    if a['err_msg']=='success.':

        #print (a['result'][0]）#终于搞定了，在这里可以输出，返回的语句

        duihua = a['result'][0]

        print ("我："+duihua)

def use_cloud(token):#进行合成

    fp = wave.open(filename, 'rb')

    nf = fp.getnframes()

    f_len = nf * 2

    audio_data = fp.readframes(nf)

    cuid = "9120612" #产品id

    srv_url = 'http://vop.baidu.com/server_api' + '?cuid=' + cuid + '&token=' + token

    http_header = [

        'Content-Type: audio/pcm; rate=8000',

        'Content-Length: %d' % f_len

    ]

    c = pycurl.Curl()

    c.setopt(pycurl.URL, str(srv_url)) #curl doesn't support unicode

    #c.setopt(c.RETURNTRANSFER, 1)

    c.setopt(c.HTTPHEADER, http_header)   #must be list, not dict

    c.setopt(c.POST, 1)

    c.setopt(c.CONNECTTIMEOUT, 30)

    c.setopt(c.TIMEOUT, 30)

    c.setopt(c.WRITEFUNCTION, dump_res)

    c.setopt(c.POSTFIELDS, audio_data)

    c.setopt(c.POSTFIELDSIZE, f_len)

    c.perform() #pycurl.perform() has no return val

# 将data中的数据保存到名为filename的WAV文件中

def save_wave_file(filename, data):

    wf = wave.open(filename, 'wb')

    wf.setnchannels(1)

    wf.setsampwidth(2)

    wf.setframerate(SAMPLING_RATE)

    wf.writeframes(b"".join(data))

    wf.close()

NUM_SAMPLES = 2000       # pyAudio内部缓存的块的大小

SAMPLING_RATE = 8000    # 取样频率

LEVEL = 1500            # 声音保存的阈值

COUNT_NUM = 20          # NUM_SAMPLES个取样之内出现COUNT_NUM个大于LEVEL的取样则记录声音

SAVE_LENGTH = 8         # 声音记录的最小长度：SAVE_LENGTH * NUM_SAMPLES 个取样

exception_on_overflow=False

# 开启声音输入ｐｙａｕｄｉｏ对象

pa = PyAudio()

stream = pa.open(format=paInt16, channels=1, rate=SAMPLING_RATE, input=True,

                frames_per_buffer=NUM_SAMPLES)

token = get_token()#获取ｔｏｋｅｎ

key = '35ff2856b55e4a7f9eeb86e3437e23fe'

api = 'http://www.tuling123.com/openapi/api?key=' + key + '&info='

while(True):

    # 读入NUM_SAMPLES个取样

    string_audio_data = stream.read(NUM_SAMPLES,False);

    # 将读入的数据转换为数组

    audio_data = np.fromstring(string_audio_data, dtype=np.short)

    # 计算大于LEVEL的取样的个数

    large_sample_count = np.sum( audio_data > LEVEL )

    temp = np.max(audio_data)

    if temp > 2000 and t == 0:

        t = 1#开启录音

        print ("---------主人我在听你说！（5S）----------")

        begin = time.time()

       # print (temp)

    if t:

        #print (np.max(audio_data))

        if np.max(audio_data)<1000:

            sum += 1

           # print (sum)

        end = time.time()

        if end-begin>5:

            time_flag = 1

           # print ("五秒到了，准备结束")

        # 如果个数大于COUNT_NUM，则至少保存SAVE_LENGTH个块

        if large_sample_count > COUNT_NUM:

            save_count = SAVE_LENGTH

        else:

            save_count -= 1

        if save_count < 0:

            save_count = 0

        if save_count > 0:

            # 将要保存的数据存放到save_buffer中

            save_buffer.append(string_audio_data )

        else:

            # 将save_buffer中的数据写入WAV文件，WAV文件的文件名是保存的时刻

            #if  time_flag:

            if len(save_buffer) > 0  or time_flag:

                #filename = datetime.now().strftime("%Y-%m-%d_%H_%M_%S") + ".wav"#原本是用时间做名字

                filename = str(flag_num)+".wav"

                flag_num += 1

                save_wave_file(filename, save_buffer)

                save_buffer = []

                t = 0

                sum =0

                time_flag = 0

              #  print (filename, "保存成功正在进行语音识别")

                use_cloud(token)

             #   print (duihua)

                info = duihua

                duihua = ""

                request = api + str(info)

                response = getHtml(request)

              #  print ( "-----1-----")

                dic_json = json.loads(response)

                a = dic_json['text']

                unicodestring = a

                # 将Unicode转化为普通Python字符串："encode"

                utf8string = unicodestring.encode("utf-8")

                print ("科塔娜："+str(a))

                # 电脑说话

                speech.say(str(a))

                url = "http://tsn.baidu.com/text2audio?tex="+dic_json['text']+"&lan=zh&per=0&pit=1&spd=7&cuid=7519663&ctp=1&tok=25.41bf315625c68b3e947c49b90788532d.315360000.1798261651.282335-9120612"

                os.system('mpg123 "%s"'%(url))

python +百度语音识别+图灵对话的更多相关文章

Python 百度语音识别与合成REST API及ffmpeg使用
操作系统:Windows Python:3.5 欢迎加入学习交流QQ群:657341423 百度语音识别官方文档百度语音合成官方文档注意事项:接口支持 POST 和 GET两种方式,个人支持用po ...
python调用百度语音识别接口实时识别
1.本文直接上干货奉献代码:https://github.com/wuzaipei/audio_discern/tree/master/%E8%AF%AD%E9%9F%B3%E8%AF%86%E5% ...
python录音并调用百度语音识别接口
#!/usr/bin/env python import requests import json import base64 import pyaudio import wave import os ...
基于百度语音识别API的Python语音识别小程序
一.功能概述实现语音为文字,可以扩展到多种场景进行工作,这里只实现其基本的语言接收及转换功能. 在语言录入时,根据语言内容的多少与停顿时间,自动截取音频进行转换. 工作示例: 二.软件环境操作系统 ...
ros实例_百度语音+图灵
1 百度语音模块参考http://blog.csdn.net/u011118482/article/details/55001444 1.1 百度语音识别包 git clonehttps://git ...
[python]百度语音rest api
百度语音识别提供的api范例只有java, c, php. 如果使用Python, 需要注意: 语音文件长度是指bytes大小可以通过len(file.read())获得使用requests.po ...
Python实时语音识别控制
代码地址如下:http://www.demodashi.com/demo/12946.html Python实时语音识别控制概述本文中的语音识别功能采用百度语音识别库 ,首先利用 PyAudio ...
百度语音识别API初探
近期想做个东西把大段对话转成文字.用语音输入法太慢,所以想到看有没有现成的API,网上一搜,基本就是百度和讯飞. 这里先看百度的笔者使用的是Java版本号的下载地址:http://bos.nj.b ...
百度语音识别REST API——通过使用Http网络请求方式获得语音识别功能
百度语音识别通过REST API的方式给开发人员提供一个通用的HTTP接口,基于该接口,开发人员能够轻松的获取语音识别能力,本文档描写叙述了使用语音识别服务REST API的方法. 长处: 较之开发人 ...

随机推荐

c# 检测是否有Sql非法字符
/// <summary> /// 检测是否有Sql危险字符 /// </summary> /// <param name="str">要判断字 ...
Android开发day-01
http://note.youdao.com/noteshare?id=b7f0d55c1e5eab20bb47e5c58e683611
前端面试整理——javascript算法和测试题
(1)算法: 1.斐波那契数列:1.1.2.3.5.8.13.21.输入n,输出数列中第n位数的值. 方案一: function fn(n){ var num1 = 1, num2= 1, num3 ...
从零开始学习html（二）认识标签(第一部分)——上
一.语义化,让你的网页更好的被搜索引擎理学习html标签过程中,主要注意两个方面的学习:标签的用途.标签在浏览器中的默认样式. 标签的用途:我们学习网页制作时,常常会听到一个词,语义化. 那么什么叫 ...
免费工资总额管控系统-JXHR2016
•工资总额是指按照国家统计局规定的统计口径或企业规定,在一定时期内支付给各类用工的劳动报酬总额 •工资总额,即基本工资,包括岗位工资.各项津补贴 •JXHR2016以薪酬管控为核心,结合人力资源规划. ...
排错-Loadrunner添加Windows Resource计数器提示“找不到网络路径”解决方法
Loadrunner添加Windows Resource计数器提示“找不到网络路径”解决方法 by:授客 QQ:1033553122 1.启动windows相关服务 win->services. ...
Quill编辑器IOS下无法获取焦点的解决方法
造成Quill-Editor无法获取焦点的大部分原因是Css的问题,罪魁祸首: *{ -webkit-user-select:none; } ios下直接造成无法获取焦点. 解决方法,覆盖以上css设 ...
(网页)人人都会的35个Jquery小技巧
转自CSDN: 收集的35个 jQuery 小技巧/代码片段,可以帮你快速开发. 1. 禁止右键点击 $(document).ready(function(){ $(document).bind(&q ...
小技巧-mac修改finder菜单栏
效果: 方法: 添加:打开finder后,长按command,可以将其他app拖到菜单栏. 删除:同理,长按command,将不需要的图标拖出菜单栏即可. PS:强烈推荐gotoshell这个小工具, ...
[20180403]访问dba_autotask_task无输出问题.txt
[20180403]访问dba_autotask_task无输出问题.txt --//链接http://www.itpub.net/thread-1911421-1-1.html的讨论,还没注意原先的 ...

python +百度语音识别+图灵对话

python +百度语音识别+图灵对话的更多相关文章

随机推荐

热门专题