網頁

2020年8月17日 星期一

Text To Speech (簡稱:TTS) 的偷吃步使用方式

前一陣子為了趕一個還算搬得上檯面,
至少必須頗具雛型,具展示性的一個成品,
我試了幾種錄製人的語音聲音的方式。

第一種,錄製自己的聲音。

找個麥克風,把自己關在安靜的地方,使用電腦主機錄聲音。
或者找錄音筆,同樣把自己關在安靜的地方,錄製聲音。
其效果都不是很好,光是去除背景雜音的後製工作,便會花費更多時間。
雖然,網路上有人在討論如何選用麥克風,但選購後如若不行,
以及多方嘗試後的硬體調整,恐怕更花時間。
這種種因素,讓我駐足,打消念頭,暫時先不採用這樣的方式。
雖然,未來可以嘗試看看,應該會很有趣。
不過也要有一直對著空氣講話,講到口渴的心理準備。
譬如:講錯,要一直重錄之類的。

第二種,使用Text to Speech(TTS)技術。

我幾年前曾試著使用TTS技術,那時候是以「英文」來呈現。
只需要輸入「文字」,它會就自動生成「語音」。
那時候找到的軟體還可以選擇講話的人的聲音,
譬如:男聲、女聲、哪一個地方的英文腔調,之類的。

我記得那時候可能技術還並不是很純熟,
所以中文支援的情況,都是需要付費的。
即便試用後,發現音色真的很怪,
最後放棄使用中文語音,改使用英文來撰寫我需要的專案。

幾年過後,上網隨便一查,就找到一個不錯的網站
https://soundoftext.com/

效果還不錯,
1. 只需要在Text裡面輸入中文,
2. Voice裡面點選人聲要講的語言。
3. 點選submit之後
4. 底下可以先PLAY,聽聽看效果
5. 或者是DOWNLOAD下來用




這個網站上DOWNLOAD下來的聲音檔,
匯入Unity後,可以直接拿來使用,不須轉檔。
有了這個TTS的技術之後,我很開心的作了很多聲音檔,
逐一匯入專案內,在想要播放聲音的步驟中,或者是按鈕裡,播放人聲作講解。

在我身邊,每個試用過HoloLens的人,
十個有九個都會問說,可不可以講中文?
第十個,可能是不知道怎麼問吧!
以後,就可以常用這個方式,作播放聲音、導覽或語音講解。

倒是,後來不知道哪根筋不對,突然想說,
使用google翻譯,錄下中文或英文的聲音,搞不好也可以。



我就試了一下效果,沒想到....
講話的人的聲音,就是上述網站的同一個人的聲音。

如果想要錄製google翻譯的聲音的話,
那就必須先讓電腦主機有辦法錄製電腦播放出來的聲音,
這個功能,網路上已經很多人在討論。

首先,要啟用立體聲混音的功能。



使用window,附屬應用程式底下的錄音機功能,即可。
只是畢竟是自己錄製的,前後的空白的錄音段落,
可能會有偏長的問題,那一樣得後製就是了。

以上作個紀錄!



沒有留言:

張貼留言