「来源: |<em>Python</em>之王 ID:sen13717378202」@Author:Runsen 1876年,亚历山大·格雷厄姆·贝尔(Alexander Graham Bell)发明了一种电报机,可以通过电线传输音频。托马斯·爱迪生(Thomas Edison)于1877年发明了留声机,这
2021-05-27 13:00:07
「來源: |Python之王 ID:sen13717378202」
@Author:Runsen
1876年,亞歷山大·格雷厄姆·貝爾(Alexander Graham Bell)發明了一種電報機,可以通過電線傳輸音訊。托馬斯·愛迪生(Thomas Edison)於1877年發明了留聲機,這是第一臺記錄聲音並播放聲音的機器。
最早的語音識別軟體之一是由Bells Labs在1952年編寫的,只能識別數字。1985年,IBM釋出了使用「隱馬爾可夫模型」的軟體,該軟體可識別1000多個單詞。
幾年前,一個replace("?","")程式碼價值一個億
如今,在Python中Tensorflow,Keras,Librosa,Kaldi和語音轉文字API等多種工具使語音計算變得更加容易。
今天,我使用gtts和speech_recognition,教大家如何通過三十行程式碼,打造一款簡單的人工語音對話。思路就是將語音變成文字,然後文字變成語音。
gtts
gtts是將文字轉化為語音,但是需要在VPN下使用。這個因為要接谷歌伺服器。
具體gtts的官方文件:
下面,讓我們看一段簡單的的程式碼
from gtts import gTTSdefspeak(audioString): print(audioString) tts = gTTS(text=audioString, lang='en') tts.save("audio.mp3") os.system("audio.mp3")speak("Hi Runsen, what can I do for you?")執行上面的程式碼,就可以生成一個mp3檔案,播放就可以聽到了Hi Runsen, what can I do for you?。這個MP3會自動彈出來的。
speech_recognition
speech_recognition用於執行語音識別的庫,支援線上和離線的多個引擎和API。
speech_recognition具體官方文件
安裝speech_recognition可以會出現錯誤,對此解決的方法是通過該網址安裝對應的whl包
在官方文件中提供了具體的識別來自麥克風的語音輸入的程式碼
下面就是 speech_recognition 用麥克風記錄下你的話,這裡我使用的是recognize_google,speech_recognition 提供了很多的類似的介面。
import timeimport speech_recognition as sr# 錄下來你講的話defrecordAudio():# 用麥克風記錄下你的話 print("開始麥克風記錄下你的話") r = sr.Recognizer()with sr.Microphone() as source: audio = r.listen(source) data = ""try: data = r.recognize_google(audio) print("You said: " + data)except sr.UnknownValueError: print("Google Speech Recognition could not understand audio")except sr.RequestError as e: print("Could not request results from Google Speech Recognition service; {0}".format(e))return dataif __name__ == '__main__': time.sleep(2)whileTrue: data = recordAudio() print(data)下面是我亂說的英語
對話
上面,我們實現了用麥克風記錄下你的話,並且得到了對應的文字,那麼下一步就是字元串的文字操作了,比如說how are you,那回答"I am fine」,然後將"I am fine」通過gtts是將文字轉化為語音
# @Author:Runsen# -*- coding: UTF-8 -*-import speech_recognition as srfrom time import ctimeimport timeimport osfrom gtts import gTTS# 講出來AI的話def speak(audioString): print(audioString) tts = gTTS(text=audioString, lang='en') tts.save("audio.mp3") os.system("audio.mp3")# 錄下來你講的話def recordAudio(): # 用麥克風記錄下你的話 r = sr.Recognizer() with sr.Microphone() as source: audio = r.listen(source) data = "" try: data = r.recognize_google(audio) print("You said: " + data) except sr.UnknownValueError: print("Google Speech Recognition could not understand audio") except sr.RequestError as e: print("Could not request results from Google Speech Recognition service; {0}".format(e)) return data# 自帶的對話技能(邏輯程式碼:rules)def jarvis(): while True: data = recordAudio() print(data) if "how are you" in data: speak("I am fine") if "time" in data: speak(ctime()) if "where is" in data: data = data.split(" ") location = data[2] speak("Hold on Runsen, I will show you where " + location + " is.") # 開啟谷歌地址 os.system("open -a Safari https://www.google.com/maps/place/" + location + "/&") if "bye" in data: speak("bye bye") breakif __name__ == '__main__': # 初始化 time.sleep(2) speak("Hi Runsen, what can I do for you?") # 跑起 jarvis()
當我說how are you?會彈出I am fine的mp3
當我說where is Chiana?會彈出Hold on Runsen, I will show you where China is.的MP3
同樣也會彈出China的谷歌地圖
本項目對應的Github
(https://github.com/MaoliRUNsen/Simple-intelligent-voice-dialogue)
相關文章
「来源: |<em>Python</em>之王 ID:sen13717378202」@Author:Runsen 1876年,亚历山大·格雷厄姆·贝尔(Alexander Graham Bell)发明了一种电报机,可以通过电线传输音频。托马斯·爱迪生(Thomas Edison)于1877年发明了留声机,这
2021-05-27 13:00:07
同时,华硕ROG还能让这款45W的处理器,释放出70W的功耗,实现更强表现。其具有16GB DDR4 3200内存,1 x SO-DIMM,最大支持40GB,说明板载8GB,单条最高可以换至32GB。512GB PCIE 4.0 <em>SSD</em>,还有第二个M.2插槽,方便扩展。其显
2021-05-27 12:01:27
在今天发布的几个公告中,西部数据(Western Digital) WD Black(西数黑盘,主要面向游戏玩家)品牌新增了一个更实惠的 PCIe Gen4 <em>SSD</em> 成员。最新推出的 WD Black SN750 SE 并非是现有 SN750 的升级,而是全新、不同的硬
2021-05-27 12:01:21
尽管TPU不是用在手机上的AI芯片,且在深度学习任务上,与 <em>CPU</em> 、GPU 、FPGA相比,任务灵活度较低。但无论如何,谷歌进军AI领域的野心已经昭然若揭。 个人移动终端上的AI应用(语音识别、图像处理等)具有如此广阔
2021-05-27 12:01:14
也就是说,笔者在前文中提到的骁龙XR2正是更加无缝的沉浸式体验的来源。据了解,上述最新VR头显均搭载了业内顶级的高通骁龙XR2平台,与骁龙835移动平台相比,该平台实现了2倍的<em>CPU</em>和GPU性能提升、6倍的分辨率提升,以
2021-05-27 12:01:09
卓越硬件性能 疾速散热无忧 高标准的视觉效果必然会对硬件性能提出严苛要求,ROG幻16选配了11代英特尔酷睿i7-11800H与NVIDIA GeForce RTX 3060独显的尖端组合。<em>CPU</em>为8核心16线程的规格,无论是多任务工作,还是开
2021-05-27 12:01:02