日韩性视频-久久久蜜桃-www中文字幕-在线中文字幕av-亚洲欧美一区二区三区四区-撸久久-香蕉视频一区-久久无码精品丰满人妻-国产高潮av-激情福利社-日韩av网址大全-国产精品久久999-日本五十路在线-性欧美在线-久久99精品波多结衣一区-男女午夜免费视频-黑人极品ⅴideos精品欧美棵-人人妻人人澡人人爽精品欧美一区-日韩一区在线看-欧美a级在线免费观看

歡迎訪問 生活随笔!

生活随笔

當(dāng)前位置: 首頁 > 编程语言 > python >内容正文

python

Python只需要三十行代码,打造一款简单的人工语音对话

發(fā)布時(shí)間:2024/10/8 python 34 豆豆
生活随笔 收集整理的這篇文章主要介紹了 Python只需要三十行代码,打造一款简单的人工语音对话 小編覺得挺不錯(cuò)的,現(xiàn)在分享給大家,幫大家做個(gè)參考.

@Author:Runsen

1876年,亞歷山大·格雷厄姆·貝爾(Alexander Graham Bell)發(fā)明了一種電報(bào)機(jī),可以通過電線傳輸音頻。托馬斯·愛迪生(Thomas Edison)于1877年發(fā)明了留聲機(jī),這是第一臺(tái)記錄聲音并播放聲音的機(jī)器。

最早的語音識(shí)別軟件之一是由Bells Labs在1952年編寫的,只能識(shí)別數(shù)字。1985年,IBM發(fā)布了使用“隱馬爾可夫模型”的軟件,該軟件可識(shí)別1000多個(gè)單詞。

幾年前,一個(gè)replace("?","")代碼價(jià)值一個(gè)億

如今,在Python中Tensorflow,Keras,Librosa,Kaldi和語音轉(zhuǎn)文本API等多種工具使語音計(jì)算變得更加容易。

今天,我使用gtts和speech_recognition,教大家如何通過三十行代碼,打造一款簡單的人工語音對話。思路就是將語音變成文本,然后文本變成語音。

gtts

gtts是將文字轉(zhuǎn)化為語音,但是需要在VPN下使用。這個(gè)因?yàn)橐庸雀璺?wù)器。

具體gtts的官方文檔:

下面,讓我們看一段簡單的的代碼

from gtts import gTTSdef speak(audioString):print(audioString)tts = gTTS(text=audioString, lang='en')tts.save("audio.mp3")os.system("audio.mp3")speak("Hi Runsen, what can I do for you?")

執(zhí)行上面的代碼,就可以生成一個(gè)mp3文件,播放就可以聽到了Hi Runsen, what can I do for you?。這個(gè)MP3會(huì)自動(dòng)彈出來的。

speech_recognition

speech_recognition用于執(zhí)行語音識(shí)別的庫,支持在線和離線的多個(gè)引擎和API。

speech_recognition具體官方文檔

安裝speech_recognition可以會(huì)出現(xiàn)錯(cuò)誤,對此解決的方法是通過該網(wǎng)址安裝對應(yīng)的whl包

在官方文檔中提供了具體的識(shí)別來自麥克風(fēng)的語音輸入的代碼

下面就是 speech_recognition 用麥克風(fēng)記錄下你的話,這里我使用的是
recognize_google,speech_recognition 提供了很多的類似的接口。

import time import speech_recognition as sr# 錄下來你講的話 def recordAudio():# 用麥克風(fēng)記錄下你的話print("開始麥克風(fēng)記錄下你的話")r = sr.Recognizer()with sr.Microphone() as source:audio = r.listen(source)data = ""try:data = r.recognize_google(audio)print("You said: " + data)except sr.UnknownValueError:print("Google Speech Recognition could not understand audio")except sr.RequestError as e:print("Could not request results from Google Speech Recognition service; {0}".format(e))return dataif __name__ == '__main__':time.sleep(2)while True:data = recordAudio()print(data)

下面是我亂說的英語

對話

上面,我們實(shí)現(xiàn)了用麥克風(fēng)記錄下你的話,并且得到了對應(yīng)的文本,那么下一步就是字符串的文本操作了,比如說how are you,那回答"I am fine”,然后將"I am fine”通過gtts是將文字轉(zhuǎn)化為語音

# @Author:Runsen # -*- coding: UTF-8 -*- import speech_recognition as sr from time import ctime import time import os from gtts import gTTS# 講出來AI的話 def speak(audioString):print(audioString)tts = gTTS(text=audioString, lang='en')tts.save("audio.mp3")os.system("audio.mp3")# 錄下來你講的話 def recordAudio():# 用麥克風(fēng)記錄下你的話r = sr.Recognizer()with sr.Microphone() as source:audio = r.listen(source)data = ""try:data = r.recognize_google(audio)print("You said: " + data)except sr.UnknownValueError:print("Google Speech Recognition could not understand audio")except sr.RequestError as e:print("Could not request results from Google Speech Recognition service; {0}".format(e))return data# 自帶的對話技能(邏輯代碼:rules) def jarvis():while True:data = recordAudio()print(data)if "how are you" in data:speak("I am fine")if "time" in data:speak(ctime())if "where is" in data:data = data.split(" ")location = data[2]speak("Hold on Runsen, I will show you where " + location + " is.")# 打開谷歌地址os.system("open -a Safari https://www.google.com/maps/place/" + location + "/&")if "bye" in data:speak("bye bye")breakif __name__ == '__main__':# 初始化time.sleep(2)speak("Hi Runsen, what can I do for you?")# 跑起jarvis()

當(dāng)我說how are you?會(huì)彈出I am fine的mp3

當(dāng)我說where is Chiana?會(huì)彈出Hold on Runsen, I will show you where China is.的MP3


同樣也會(huì)彈出China的谷歌地圖

本項(xiàng)目對應(yīng)的Github

總結(jié)

以上是生活随笔為你收集整理的Python只需要三十行代码,打造一款简单的人工语音对话的全部內(nèi)容,希望文章能夠幫你解決所遇到的問題。

如果覺得生活随笔網(wǎng)站內(nèi)容還不錯(cuò),歡迎將生活随笔推薦給好友。