主頁 > 知識庫 > 30行Python代碼打造一款簡單的人工語音對話

30行Python代碼打造一款簡單的人工語音對話

熱門標(biāo)簽:沈陽防封電銷卡品牌 武漢外呼系統(tǒng)平臺 富錦商家地圖標(biāo)注 外呼系統(tǒng)哪些好辦 沈陽人工外呼系統(tǒng)價(jià)格 如何申請400電話費(fèi)用 池州外呼調(diào)研線路 沈陽外呼系統(tǒng)呼叫系統(tǒng) 江西省地圖標(biāo)注

@Author:Runsen

1876年,亞歷山大·格雷厄姆·貝爾(Alexander Graham Bell)發(fā)明了一種電報(bào)機(jī),可以通過電線傳輸音頻。托馬斯·愛迪生(Thomas Edison)于1877年發(fā)明了留聲機(jī),這是第一臺記錄聲音并播放聲音的機(jī)器。

最早的語音識別軟件之一是由Bells Labs在1952年編寫的,只能識別數(shù)字。1985年,IBM發(fā)布了使用“隱馬爾可夫模型”的軟件,該軟件可識別1000多個(gè)單詞。

幾年前,一個(gè)replace("?","")代碼價(jià)值一個(gè)億

如今,在Python中Tensorflow,Keras,Librosa,Kaldi和語音轉(zhuǎn)文本API等多種工具使語音計(jì)算變得更加容易。

今天,我使用gtts和speech_recognition,教大家如何通過三十行代碼,打造一款簡單的人工語音對話。思路就是將語音變成文本,然后文本變成語音。

gtts

gtts是將文字轉(zhuǎn)化為語音,但是需要在VPN下使用。這個(gè)因?yàn)橐庸雀璺?wù)器。

具體gtts的官方文檔:

下面,讓我們看一段簡單的的代碼

from gtts import gTTS

def speak(audioString):
    print(audioString)
    tts = gTTS(text=audioString, lang='en')
    tts.save("audio.mp3")
    os.system("audio.mp3")
    
speak("Hi Runsen, what can I do for you?")

執(zhí)行上面的代碼,就可以生成一個(gè)mp3文件,播放就可以聽到了Hi Runsen, what can I do for you?。這個(gè)MP3會自動彈出來的。

speech_recognition

speech_recognition用于執(zhí)行語音識別的庫,支持在線和離線的多個(gè)引擎和API。

speech_recognition具體官方文檔

安裝speech_recognition可以會出現(xiàn)錯(cuò)誤,對此解決的方法是通過該網(wǎng)址安裝對應(yīng)的whl包

在官方文檔中提供了具體的識別來自麥克風(fēng)的語音輸入的代碼

下面就是 speech_recognition 用麥克風(fēng)記錄下你的話,這里我使用的是
recognize_google,speech_recognition 提供了很多的類似的接口。

import time
import speech_recognition as sr

# 錄下來你講的話
def recordAudio():
    # 用麥克風(fēng)記錄下你的話
    print("開始麥克風(fēng)記錄下你的話")
    r = sr.Recognizer()
    with sr.Microphone() as source:
        audio = r.listen(source)
    data = ""
    try:
        data = r.recognize_google(audio)
        print("You said: " + data)
    except sr.UnknownValueError:
        print("Google Speech Recognition could not understand audio")
    except sr.RequestError as e:
        print("Could not request results from Google Speech Recognition service; {0}".format(e))
    return data

if __name__ == '__main__':
    time.sleep(2)
    while True:
        data = recordAudio()
        print(data)

下面是我亂說的英語

對話

上面,我們實(shí)現(xiàn)了用麥克風(fēng)記錄下你的話,并且得到了對應(yīng)的文本,那么下一步就是字符串的文本操作了,比如說how are you,那回答"I am fine”,然后將"I am fine”通過gtts是將文字轉(zhuǎn)化為語音

# @Author:Runsen
# -*- coding: UTF-8 -*-
import speech_recognition as sr
from time import ctime
import time
import os
from gtts import gTTS


# 講出來AI的話
def speak(audioString):
    print(audioString)
    tts = gTTS(text=audioString, lang='en')
    tts.save("audio.mp3")
    os.system("audio.mp3")


# 錄下來你講的話
def recordAudio():
    # 用麥克風(fēng)記錄下你的話
    r = sr.Recognizer()
    with sr.Microphone() as source:
        audio = r.listen(source)

    data = ""
    try:
        data = r.recognize_google(audio)
        print("You said: " + data)
    except sr.UnknownValueError:
        print("Google Speech Recognition could not understand audio")
    except sr.RequestError as e:
        print("Could not request results from Google Speech Recognition service; {0}".format(e))

    return data


# 自帶的對話技能(邏輯代碼:rules)
def jarvis():
    while True:
        data = recordAudio()
        print(data)
        if "how are you" in data:
            speak("I am fine")
        if "time" in data:
            speak(ctime())
        if "where is" in data:
            data = data.split(" ")
            location = data[2]
            speak("Hold on Runsen, I will show you where " + location + " is.")
            # 打開谷歌地址
            os.system("open -a Safari https://www.google.com/maps/place/" + location + "/")

        if "bye" in data:
            speak("bye bye")
            break


if __name__ == '__main__':
    # 初始化
    time.sleep(2)
    speak("Hi Runsen, what can I do for you?")

    # 跑起
    jarvis()

當(dāng)我說how are you?會彈出I am fine的mp3

當(dāng)我說where is Chiana?會彈出Hold on Runsen, I will show you where China is.的MP3

同樣也會彈出China的谷歌地圖

本項(xiàng)目對應(yīng)的Github

以上就是30行Python代碼打造一款簡單的人工語音對話的詳細(xì)內(nèi)容,更多關(guān)于Python人工語音對話的資料請關(guān)注腳本之家其它相關(guān)文章!

您可能感興趣的文章:
  • python3實(shí)現(xiàn)語音轉(zhuǎn)文字(語音識別)和文字轉(zhuǎn)語音(語音合成)
  • 使用Python將語音轉(zhuǎn)換為文本的方法
  • Python將文字轉(zhuǎn)成語音并讀出來的實(shí)例詳解
  • 使用Python實(shí)現(xiàn)文字轉(zhuǎn)語音并生成wav文件的例子
  • python教程十行代碼教你語音轉(zhuǎn)文字QQ微信聊天

標(biāo)簽:阿里 通遼 常德 黑龍江 株洲 呂梁 潛江 銅川

巨人網(wǎng)絡(luò)通訊聲明:本文標(biāo)題《30行Python代碼打造一款簡單的人工語音對話》,本文關(guān)鍵詞  30行,Python,代碼,打造,一款,;如發(fā)現(xiàn)本文內(nèi)容存在版權(quán)問題,煩請?zhí)峁┫嚓P(guān)信息告之我們,我們將及時(shí)溝通與處理。本站內(nèi)容系統(tǒng)采集于網(wǎng)絡(luò),涉及言論、版權(quán)與本站無關(guān)。
  • 相關(guān)文章
  • 下面列出與本文章《30行Python代碼打造一款簡單的人工語音對話》相關(guān)的同類信息!
  • 本頁收集關(guān)于30行Python代碼打造一款簡單的人工語音對話的相關(guān)信息資訊供網(wǎng)民參考!
  • 推薦文章