猫史档案馆


python语音识别终极指南

用户:上帝之鹰上帝之鹰查看:0 回复:1 评论:0 创建时间:2020-05-02T11:26:01


在上一章中(网址:https://shequ.codemao.cn/community/273186)我们完成了百度语音识别的准备工作,这一章,我们就来写代码。

提前声明:我用的是python3.8.喵编辑器

所以,如果你在海龟编辑器或其他(如mu、PyCharm等)编辑器上出现异常,不是我代码错误哦!

首先,打开命令提示符,输入:

pip install aip

下载完毕后去python编辑器里导入试试看,如果导入成功,就说明下载成功了

然后写代码。

废话不多说,我直接把代码给出来:

import os
from aip import AipSpeech

""" 你的 APPID AK SK """
APP_ID = '你的APP_ID'
API_KEY = '你的API_KEY'
SECRET_KEY = '你的SECRET_KEY'

client = AipSpeech(APP_ID, API_KEY, SECRET_KEY)

# 读取文件
def get_file_content(filePath):
    cmd_str = "ffmpeg -y  -i %s  -acodec pcm_s16le -f s16le -ac 1 -ar 16000 %s.pcm"%(filePath,filePath)
    os.system(cmd_str)  # 调用系统命令ffmpeg,传入音频文件名即可
    with open(filePath + ".pcm", 'rb') as fp:
        return fp.read()

# 识别本地文件
a = client.asr(get_file_content('test.wav'), 'pcm', 16000, {'dev_pid': 1536})
b = a.get('result')[0]
print(b)

录制一个文件,识别一下试试吧!


回复

上一页1 页 / 共 1下一页
lsk666666lsk666666

用FFmpeg是给音频转码吧……

而且这玩意儿好像要自己编译……

点赞0


评论