人妖在线一区,国产日韩欧美一区二区综合在线,国产啪精品视频网站免费,欧美内射深插日本少妇

新聞動態(tài)

30行Python代碼打造一款簡單的人工語音對話

發(fā)布日期:2022-05-07 14:17 | 文章來源:源碼中國

@Author:Runsen

1876年,亞歷山大·格雷厄姆·貝爾(Alexander Graham Bell)發(fā)明了一種電報機,可以通過電線傳輸音頻。托馬斯·愛迪生(Thomas Edison)于1877年發(fā)明了留聲機,這是第一臺記錄聲音并播放聲音的機器。

最早的語音識別軟件之一是由Bells Labs在1952年編寫的,只能識別數(shù)字。1985年,IBM發(fā)布了使用“隱馬爾可夫模型”的軟件,該軟件可識別1000多個單詞。

幾年前,一個replace("?","")代碼價值一個億

如今,在Python中Tensorflow,Keras,Librosa,Kaldi和語音轉(zhuǎn)文本API等多種工具使語音計算變得更加容易。

今天,我使用gtts和speech_recognition,教大家如何通過三十行代碼,打造一款簡單的人工語音對話。思路就是將語音變成文本,然后文本變成語音。

gtts

gtts是將文字轉(zhuǎn)化為語音,但是需要在VPN下使用。這個因為要接谷歌服務(wù)器。

具體gtts的官方文檔:

下面,讓我們看一段簡單的的代碼

from gtts import gTTS
def speak(audioString):
 print(audioString)
 tts = gTTS(text=audioString, lang='en')
 tts.save("audio.mp3")
 os.system("audio.mp3")
 
speak("Hi Runsen, what can I do for you?")

執(zhí)行上面的代碼,就可以生成一個mp3文件,播放就可以聽到了Hi Runsen, what can I do for you?。這個MP3會自動彈出來的。

speech_recognition

speech_recognition用于執(zhí)行語音識別的庫,支持在線和離線的多個引擎和API。

speech_recognition具體官方文檔

安裝speech_recognition可以會出現(xiàn)錯誤,對此解決的方法是通過該網(wǎng)址安裝對應(yīng)的whl包

在官方文檔中提供了具體的識別來自麥克風(fēng)的語音輸入的代碼

下面就是 speech_recognition 用麥克風(fēng)記錄下你的話,這里我使用的是
recognize_google,speech_recognition 提供了很多的類似的接口。

import time
import speech_recognition as sr
# 錄下來你講的話
def recordAudio():
 # 用麥克風(fēng)記錄下你的話
 print("開始麥克風(fēng)記錄下你的話")
 r = sr.Recognizer()
 with sr.Microphone() as source:
  audio = r.listen(source)
 data = ""
 try:
  data = r.recognize_google(audio)
  print("You said: " + data)
 except sr.UnknownValueError:
  print("Google Speech Recognition could not understand audio")
 except sr.RequestError as e:
  print("Could not request results from Google Speech Recognition service; {0}".format(e))
 return data
if __name__ == '__main__':
 time.sleep(2)
 while True:
  data = recordAudio()
  print(data)

下面是我亂說的英語

對話

上面,我們實現(xiàn)了用麥克風(fēng)記錄下你的話,并且得到了對應(yīng)的文本,那么下一步就是字符串的文本操作了,比如說how are you,那回答"I am fine”,然后將"I am fine”通過gtts是將文字轉(zhuǎn)化為語音

# @Author:Runsen
# -*- coding: UTF-8 -*-
import speech_recognition as sr
from time import ctime
import time
import os
from gtts import gTTS

# 講出來AI的話
def speak(audioString):
 print(audioString)
 tts = gTTS(text=audioString, lang='en')
 tts.save("audio.mp3")
 os.system("audio.mp3")

# 錄下來你講的話
def recordAudio():
 # 用麥克風(fēng)記錄下你的話
 r = sr.Recognizer()
 with sr.Microphone() as source:
  audio = r.listen(source)
 data = ""
 try:
  data = r.recognize_google(audio)
  print("You said: " + data)
 except sr.UnknownValueError:
  print("Google Speech Recognition could not understand audio")
 except sr.RequestError as e:
  print("Could not request results from Google Speech Recognition service; {0}".format(e))
 return data

# 自帶的對話技能(邏輯代碼:rules)
def jarvis():
 while True:
  data = recordAudio()
  print(data)
  if "how are you" in data:
speak("I am fine")
  if "time" in data:
speak(ctime())
  if "where is" in data:
data = data.split(" ")
location = data[2]
speak("Hold on Runsen, I will show you where " + location + " is.")
# 打開谷歌地址
os.system("open -a Safari https://www.google.com/maps/place/" + location + "/&")
  if "bye" in data:
speak("bye bye")
break

if __name__ == '__main__':
 # 初始化
 time.sleep(2)
 speak("Hi Runsen, what can I do for you?")
 # 跑起
 jarvis()

當(dāng)我說how are you?會彈出I am fine的mp3

當(dāng)我說where is Chiana?會彈出Hold on Runsen, I will show you where China is.的MP3

同樣也會彈出China的谷歌地圖

本項目對應(yīng)的Github

以上就是30行Python代碼打造一款簡單的人工語音對話的詳細(xì)內(nèi)容,更多關(guān)于Python人工語音對話的資料請關(guān)注本站其它相關(guān)文章!

香港服務(wù)器租用

版權(quán)聲明:本站文章來源標(biāo)注為YINGSOO的內(nèi)容版權(quán)均為本站所有,歡迎引用、轉(zhuǎn)載,請保持原文完整并注明來源及原文鏈接。禁止復(fù)制或仿造本網(wǎng)站,禁止在非www.sddonglingsh.com所屬的服務(wù)器上建立鏡像,否則將依法追究法律責(zé)任。本站部分內(nèi)容來源于網(wǎng)友推薦、互聯(lián)網(wǎng)收集整理而來,僅供學(xué)習(xí)參考,不代表本站立場,如有內(nèi)容涉嫌侵權(quán),請聯(lián)系alex-e#qq.com處理。

相關(guān)文章

實時開通

自選配置、實時開通

免備案

全球線路精選!

全天候客戶服務(wù)

7x24全年不間斷在線

專屬顧問服務(wù)

1對1客戶咨詢顧問

在線
客服

在線客服:7*24小時在線

客服
熱線

400-630-3752
7*24小時客服服務(wù)熱線

關(guān)注
微信

關(guān)注官方微信
頂部