Python第三方函式庫gTTs/pyttsx3/speech怎麼使用-Python教學-PHP中文網

首頁

後端開發

Python教學

Python第三方函式庫gTTs/pyttsx3/speech怎麼使用

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

May 12, 2023 pm 06:43 PM

pythonspeech

Python文字轉語音(研究&成品函數)

由於專案需要, 我需要將文字轉換為語音, 那麼第一步就要進行研究

什麼是語音合成技術?

語音合成（text to speech）,簡稱TTS。是將文字轉化為語音的一種技術，是讓電腦模擬人類的嘴巴，透過不同的音色說出想表達的內容, 是人機對話的一部分。
TTS可以透過神經網路的設計，把文字智慧地轉化為自然語音流。極大的方便了視障患者的使用, 也提升了文本的可讀性。 TTS應用包括語音驅動的硬體以及聲音敏感系統，並常與聲音辨識程式一起使用。

現在許多廠商都推出了自己的語音合成服務或API, 大家也可以去自行查看, 本文僅做了python環境下語音合成第三方庫的調查

如何用程式碼實現?

如前文所述, 雖然市面上產品繁多, 但是作為一個開發者, 我想要一款免費的, 可程式碼調試的工具 , 經過查找材料, 我找到了gTTs庫、pyttsx3庫、speech庫都能滿足我的需求, 來做個橫向對比, 可以讓大家少走彎路。

##speechX

第三方程式庫名稱	需要連網	支援中英文	支援日文	可調語速	像人聲程度
#ggts	√	√	√	X	很像導航
pyttsx3	X	# √	X	√	適合閱讀小說

# √
X
X

很像快一點的導航

gTTS函式庫

gTTS庫(Google Text-to-Speech)

: 用於與Google Translate 的文字轉語音API 進行互動。將語音mp3資料寫入檔案

優點: 支援包括中英日文在內的多種語言, 有Google翻譯API的加持, 人聲蠻好聽

缺點: 不支援語速調節, 每次使用必須科學上網, 不能單機使用在語音播放功能, 我們選用了兩種方法

第一種是playsound庫自動播放音訊(不可調播放進度)

第二種是os函式庫呼叫系統自帶播放器(可調式進度)

請看
playsound庫播放& GTTS函式庫轉文字
函數

# 函数功能: 用gtts库阅读文本,保存为.mp3文件后, 用系统内置的浏览器阅读出来, 打开mp3文件, 函数执行结束(播放方式为os库)
def gtts_os_debug(text,mp3_filepath,language):#参数说明:参数1是朗读的文字,参数2是保存路径,参数3是数字{0英文,1中文,2日语}
    #大成功,可惜的是os调用自带播放器, 实际上只执行了"打开mp3"的操作, 它并不会在音频播报完后再进行下一条语句
    from gtts import gTTS
    import os
    # 已知zh-tw版本违和感较高,所以我们用zh-CN来进行后续工作
    if int(language) ==0 :
        s = gTTS(text=text, lang=&#39;en&#39;, tld=&#39;com&#39;)
        # s = gTTS(text=text, lang=&#39;en&#39;, tld=&#39;co.uk&#39;)#我比较喜欢美音,但是如果你喜欢英国口音可以尝试这个
    elif int(language) ==1 :
        s = gTTS(text=text, lang=&#39;zh-CN&#39;)
    elif int(language) ==2 :
        s = gTTS(text=text, lang=&#39;ja&#39;)
    try:
        s.save(mp3_filepath)
    except:
        os.remove(mp3_filepath)
        print(mp3_filepath,"文件已经存在,但是没有关系!已经删掉了")
        s.save(mp3_filepath)
    print(mp3_filepath,"保存成功")
    os.system(mp3_filepath)#调用系统自带的播放器播放MP3
gtts_os_debug(text="I&#39;m gtts library,from google Artificial Intelligence & Google Translate.",mp3_filepath="gtts英文测试.mp3",language=0)
gtts_os_debug(text="我是gtts库, 你想听听我的声音吗",mp3_filepath="gtts中文测试.mp3",language=1)
gtts_os_debug(text="真実はいつもひとつ" ,mp3_filepath="gtts日语测试.mp3",language=2)

請看

os函式庫播放& GTTS函式庫轉文字函數

# 函数功能: 用gtts库阅读文本,保存为.mp3文件后, 用playsound库阅读出来, 阅读完毕, 函数执行结束
def gtts_debug(text,mp3_filepath,language):#参数说明:参数1是朗读的文字,参数2是保存路径,参数3是数字{0英文,1中文,2日语}
    #大成功,已经实现了定制化文字转语音,但是播放的playsound需要改进(playsound库本身可能会出现bug...)
    from gtts import gTTS
    from playsound import playsound
    import os
    if int(language) ==0 :
        s = gTTS(text=text, lang=&#39;en&#39;, tld=&#39;com&#39;)
        # s = gTTS(text=text, lang=&#39;en&#39;, tld=&#39;co.uk&#39;)#我比较喜欢美音,但是如果你喜欢英国口音可以尝试这个
    elif int(language) ==1 :
        s = gTTS(text=text, lang=&#39;zh-CN&#39;)
    elif int(language) ==2 :
        s = gTTS(text=text, lang=&#39;ja&#39;)
    try:
        s.save(mp3_filepath)
    except:
        os.remove(mp3_filepath)
        print(mp3_filepath,"文件已经存在,但是没有关系!已经删掉了")
        s.save(mp3_filepath)
    print(mp3_filepath,"保存成功")
    playsound(mp3_filepath)
gtts_debug(text="I&#39;m gtts library,from google Artificial Intelligence & Google Translate.",mp3_filepath="gtts英文测试.mp3",language=0)
gtts_debug(text="我是gtts库, 你想听听我的声音吗",mp3_filepath="gtts中文测试.mp3",language=1)
gtts_debug(text="真実はいつもひとつ" ,mp3_filepath="gtts日语测试.mp3",language=2)

pyttsx3函式庫########## pyttsx3庫### : 是Python中的文字到語音轉換庫, 它可以離線工作###優點: 可以脫機工作, 支援將語音直接朗讀, 可調節音量和速度###缺點: 初始只有英語(女)和中文(女)的語音包, 其他語言的語音包需要另外下載######請看###pyttsx3庫轉文字&自朗讀###函數###

def pyttsx3_debug(text,language,rate,volume,filename,sayit=0):
    #参数说明: 六个重要参数,阅读的文字,语言(0-英文/1-中文),语速,音量(0-1),保存的文件名(以.mp3收尾),是否发言(0否1是)
    import pyttsx3
    engine = pyttsx3.init()  # 初始化语音引擎
    engine.setProperty(&#39;rate&#39;, rate)  # 设置语速
    #速度调试结果:50戏剧化的慢,200正常,350用心听小说,500敷衍了事
    engine.setProperty(&#39;volume&#39;, volume)  # 设置音量
    voices = engine.getProperty(&#39;voices&#39;)  # 获取当前语音的详细信息
    if int(language)==0:
        engine.setProperty(&#39;voice&#39;, voices[0].id)  # 设置第一个语音合成器 #改变索引，改变声音。0中文,1英文(只有这两个选择)
    elif int(language)==1:
        engine.setProperty(&#39;voice&#39;, voices[1].id)
    if int(sayit)==1:
        engine.say(text)  # pyttsx3->将结果念出来
    elif int(sayit)==0:
        print("那我就不念了哈")
    engine.save_to_file(text, filename) # 保存音频文件
    print(filename,"保存成功")
    engine.runAndWait() # pyttsx3结束语句(必须加)
    engine.stop() # pyttsx3结束语句(必须加)
pyttsx3_debug(text="我是pyttsx3, 初次见面, 给您拜个早年",language=0,rate=200,volume=0.9,filename="ptttsx3中文测试.mp3",sayit=1)
pyttsx3_debug(text="I&#39;m fake Siri, your smart voice Manager",language=1,rate=200,volume=0.9,filename="ptttsx3英文测试.mp3",sayit=1)

###speech庫#########speech### : 基於Windows的語音合成模組, 一行程式碼即可實現朗讀###優點: 依靠windows系統, 安裝使用究極簡單, 超級方便。 ###適合在程式碼調試過程中, 讓冰冷的AI語言來罵醒寫bug的我QAQ###缺點: 只有系統語言(中文&英文), 不支持語速調節和音頻導出##### #請看###speech轉文字###函數###

import speech
speech.say("甘霖娘,又出bug了")
speech.say("Don&#39;t ask me .I have no idea why bug exist again")
# 如你所见, 代码编译究极简单, 而且单机, 但是!每次使用都会呼出微软语音助手...

以上是Python第三方函式庫gTTs/pyttsx3/speech怎麼使用的詳細內容。更多資訊請關注PHP中文網其他相關文章！

陳述

本文轉載於：亿速云。如有侵權，請聯絡admin@php.cn刪除

Python：遊戲，Guis等Apr 13, 2025 am 12:14 AM

Python在遊戲和GUI開發中表現出色。 1)遊戲開發使用Pygame，提供繪圖、音頻等功能，適合創建2D遊戲。 2)GUI開發可選擇Tkinter或PyQt，Tkinter簡單易用，PyQt功能豐富，適合專業開發。

Python vs.C：申請和用例Apr 12, 2025 am 12:01 AM

Python适合数据科学、Web开发和自动化任务，而C 适用于系统编程、游戏开发和嵌入式系统。Python以简洁和强大的生态系统著称，C 则以高性能和底层控制能力闻名。

2小時的Python計劃：一種現實的方法Apr 11, 2025 am 12:04 AM

2小時內可以學會Python的基本編程概念和技能。 1.學習變量和數據類型，2.掌握控制流（條件語句和循環），3.理解函數的定義和使用，4.通過簡單示例和代碼片段快速上手Python編程。

Python：探索其主要應用程序Apr 10, 2025 am 09:41 AM

Python在web開發、數據科學、機器學習、自動化和腳本編寫等領域有廣泛應用。 1)在web開發中，Django和Flask框架簡化了開發過程。 2)數據科學和機器學習領域，NumPy、Pandas、Scikit-learn和TensorFlow庫提供了強大支持。 3)自動化和腳本編寫方面，Python適用於自動化測試和系統管理等任務。