Python需要三十行代碼,打造一款簡單的人工語音對話

      網友投稿 845 2022-05-29

      Python只需要三十行代碼,打造一款簡單的人工語音對話

      @Author:Runsen

      1876年,亞歷山大·格雷厄姆·貝爾(Alexander Graham Bell)發明了一種電報機,可以通過電線傳輸音頻。托馬斯·愛迪生(Thomas Edison)于1877年發明了留聲機,這是第一臺記錄聲音并播放聲音的機器。

      最早的語音識別軟件之一是由Bells Labs在1952年編寫的,只能識別數字。1985年,IBM發布了使用“隱馬爾可夫模型”的軟件,該軟件可識別1000多個單詞。

      幾年前,一個replace("?","")代碼價值一個億

      如今,在Python中Tensorflow,Keras,Librosa,Kaldi和語音轉文本API等多種工具使語音計算變得更加容易。

      今天,我使用gtts和speech_recognition,教大家如何通過三十行代碼,打造一款簡單的人工語音對話。思路就是將語音變成文本,然后文本變成語音。

      gtts

      gtts是將文字轉化為語音,但是需要在VPN下使用。這個因為要接谷歌服務器。

      具體gtts的官方文檔:

      下面,讓我們看一段簡單的的代碼

      from gtts import gTTS def speak(audioString): print(audioString) tts = gTTS(text=audioString, lang='en') tts.save("audio.mp3") os.system("audio.mp3") speak("Hi Runsen, what can I do for you?")

      1

      2

      3

      4

      5

      6

      7

      8

      9

      執行上面的代碼,就可以生成一個mp3文件,播放就可以聽到了Hi Runsen, what can I do for you?。這個MP3會自動彈出來的。

      speech_recognition

      speech_recognition用于執行語音識別的庫,支持在線和離線的多個引擎和API。

      speech_recognition具體官方文檔

      安裝speech_recognition可以會出現錯誤,對此解決的方法是通過該網址安裝對應的whl包

      在官方文檔中提供了具體的識別來自麥克風的語音輸入的代碼

      下面就是 speech_recognition 用麥克風記錄下你的話,這里我使用的是

      recognize_google,speech_recognition 提供了很多的類似的接口。

      import time import speech_recognition as sr # 錄下來你講的話 def recordAudio(): # 用麥克風記錄下你的話 print("開始麥克風記錄下你的話") r = sr.Recognizer() with sr.Microphone() as source: audio = r.listen(source) data = "" try: data = r.recognize_google(audio) print("You said: " + data) except sr.UnknownValueError: print("Google Speech Recognition could not understand audio") except sr.RequestError as e: print("Could not request results from Google Speech Recognition service; {0}".format(e)) return data if __name__ == '__main__': time.sleep(2) while True: data = recordAudio() print(data)

      1

      2

      3

      4

      5

      6

      7

      8

      9

      10

      11

      12

      13

      14

      15

      16

      17

      18

      19

      20

      21

      22

      23

      24

      25

      下面是我亂說的英語

      對話

      上面,我們實現了用麥克風記錄下你的話,并且得到了對應的文本,那么下一步就是字符串的文本操作了,比如說how are you,那回答"I am fine”,然后將"I am fine”通過gtts是將文字轉化為語音

      # @Author:Runsen # -*- coding: UTF-8 -*- import speech_recognition as sr from time import ctime import time import os from gtts import gTTS # 講出來AI的話 def speak(audioString): print(audioString) tts = gTTS(text=audioString, lang='en') tts.save("audio.mp3") os.system("audio.mp3") # 錄下來你講的話 def recordAudio(): # 用麥克風記錄下你的話 r = sr.Recognizer() with sr.Microphone() as source: audio = r.listen(source) data = "" try: data = r.recognize_google(audio) print("You said: " + data) except sr.UnknownValueError: print("Google Speech Recognition could not understand audio") except sr.RequestError as e: print("Could not request results from Google Speech Recognition service; {0}".format(e)) return data # 自帶的對話技能(邏輯代碼:rules) def jarvis(): while True: data = recordAudio() print(data) if "how are you" in data: speak("I am fine") if "time" in data: speak(ctime()) if "where is" in data: data = data.split(" ") location = data[2] speak("Hold on Runsen, I will show you where " + location + " is.") # 打開谷歌地址 os.system("open -a Safari https://www.google.com/maps/place/" + location + "/&") if "bye" in data: speak("bye bye") break if __name__ == '__main__': # 初始化 time.sleep(2) speak("Hi Runsen, what can I do for you?") # 跑起 jarvis()

      1

      2

      3

      4

      5

      6

      7

      8

      9

      10

      11

      12

      13

      14

      15

      16

      17

      18

      19

      20

      21

      22

      23

      24

      25

      26

      27

      28

      29

      30

      31

      32

      33

      34

      35

      36

      37

      38

      39

      40

      41

      42

      43

      44

      45

      46

      47

      48

      49

      50

      51

      52

      53

      54

      55

      56

      57

      58

      59

      60

      61

      62

      63

      64

      當我說how are you?會彈出I am fine的mp3

      當我說where is Chiana?會彈出Hold on Runsen, I will show you where China is.的MP3

      同樣也會彈出China的谷歌地圖

      本項目對應的Github

      Python 語音通話

      版權聲明:本文內容由網絡用戶投稿,版權歸原作者所有,本站不擁有其著作權,亦不承擔相應法律責任。如果您發現本站中有涉嫌抄襲或描述失實的內容,請聯系我們jiasou666@gmail.com 處理,核實后本網站將在24小時內刪除侵權內容。

      上一篇:使用Python版Paho框架開發原生MQTT接口
      下一篇:Kubernetes官方java客戶端之五:proto基本操作
      相關文章
      久久精品国产亚洲av瑜伽| 亚洲中文字幕久在线| 亚洲依依成人亚洲社区| 亚洲国产成人精品久久| 亚洲春黄在线观看| 亚洲色图在线观看| 亚洲AV日韩精品久久久久久| 亚洲AV永久纯肉无码精品动漫| 国产精品亚洲玖玖玖在线观看| 亚洲视频在线免费| 亚洲熟伦熟女新五十路熟妇| 亚洲人成网站色在线入口| 亚洲精品一级无码鲁丝片| 久久精品国产精品亚洲艾草网美妙| xvideos亚洲永久网址| 国产亚洲精品第一综合| 激情婷婷成人亚洲综合| 亚洲?V无码乱码国产精品| 亚洲?V无码乱码国产精品| 亚洲日韩中文在线精品第一| 久久精品夜色噜噜亚洲A∨| 亚洲中久无码永久在线观看同| 久久亚洲国产成人精品无码区| 亚洲欧洲自拍拍偷精品 美利坚| 国产亚洲一区二区三区在线不卡 | 亚洲jjzzjjzz在线观看| 亚洲一区二区三区在线网站| 亚洲天堂男人影院| 亚洲国产精品美女久久久久| 无码天堂va亚洲va在线va| 亚洲福利在线播放| 亚洲自偷自偷图片| 亚洲AV无码精品色午夜果冻不卡| 亚洲嫩模在线观看| 亚洲午夜精品在线| 亚洲欧美成人av在线观看| 亚洲?V无码成人精品区日韩| 国产自偷亚洲精品页65页| 久久亚洲精品成人综合| 亚洲国产韩国一区二区| 亚洲成a∧人片在线观看无码|