亚洲国产精品无码久久一线,久久夜色撩人精品国产小说,久久99精品国产麻豆蜜芽

轉自: http://www.shnenglu.com/biao/archive/2009/05/15/83048.html

文本語音（Text-to-Speech，以下簡稱TTS），它的作用就是把通過TTS引擎把文本轉化為語音輸出。本文不是講述如何建立自己的TTS引擎，而是簡單介紹如何運用Microsoft Speech SDK 建立自己的文本語音轉換應用程序。

　　 Microsoft Speech SDK簡介

　　 Microsoft Speech SDK是微軟提供的軟件開發包，提供的Speech API （SAPI）主要包含兩大方面：

　　 1． API for Text-to-Speech

　　 2． API for Speech Recognition

　　其中API for Text-to-Speech，就是微軟TTS引擎的接口，通過它我們可以很容易地建立功能強大的文本語音程序，金山詞霸的單詞朗讀功能就用到了這寫API，而目前幾乎所有的文本朗讀工具都是用這個SDK開發的。至于API for Speech Recognition就是與TTS相對應的語音識別，語音技術是一種令人振奮的技術，但由于目前語音識別技術準確度和識別速度不太理想，還未達到廣泛應用的要求。

　　 Microsoft Speech SDK可以在微軟的網站免費下載，目前的版本是5.1，為了支持中文，還要把附加的語言包（LangPack）一起下載。

　　為了在VC中使用這SDK，必需在工程中添加SDK的include和lib目錄，為免每個工程都添加目錄，最好的辦法是在VC的

　　 Option-＞Directoris立加上SDK的include和lib目錄。

　　一個最簡單的例子

　　先看一個入門的例子：

#include ＜sapi.h＞

#pragma comment(lib,"ole32.lib") //CoInitialize CoCreateInstance需要調用ole32.dll
#pragma comment(lib,"sapi.lib") //sapi.lib在SDK的lib目錄,必需正確配置
int main(int argc, char* argv[])
{
ISpVoice * pVoice = NULL;

//COM初始化：
if (FAILED(::CoInitialize(NULL)))
return FALSE;

//獲取ISpVoice接口：
HRESULT hr = CoCreateInstance(CLSID_SpVoice, NULL, CLSCTX_ALL, IID_ISpVoice, (void **)&pVoice);
if( SUCCEEDED( hr ) )
{
hr = pVoice-＞Speak(L"Hello world", 0, NULL);
pVoice-＞Release();
pVoice = NULL;
}

//千萬不要忘記：
::CoUninitialize();
return TRUE;
}

　　短短20幾行代碼就實現了文本語音轉換，夠神奇吧。SDK提供的SAPI是基于COM封裝的，無論你是否熟悉COM，只要按部就班地用CoInitialize()， CoCreateInstance()獲取IspVoice接口就夠了，需要注意的是初始化COM后，程序結束前一定要用CoUninitialize()釋放資源。

　　 IspVoice接口主要函數

　　上述程序的流程是獲取IspVoice接口，然后用ISpVoice::Speak（）把文本輸出為語音，可見，程序的核心就是IspVoice接口。除了Speak外IspVoice接口還有許多成員函數，具體用法請參考SDK的文檔。下面擇要說一下幾個主要函數的用法： HRESULT Speak(const WCHAR *pwcs,DWORD dwFlags,ULONG *pulStreamNumber);

　　功能：就是speak了

　　參數：

　　　 *pwcs 輸入的文本字符串，必需為Unicode，如果是ansi字符串必需先轉換為Unicode。

　　　 dwFlags 用來標志Speak的方式，其中SPF_IS_XML 表示輸入文本含有XML標簽，這個下文會講到。

　　　 PulStreamNumber 輸出，用來獲取去當前文本輸入的等候播放隊列的位置，只有在異步模式才有用。

HRESULT Pause ( void );
HRESULT Resume ( void );

　　功能：一看就知道了。

HRESULT SetRate(long RateAdjust );
HRESULT GetRate(long *pRateAdjust);

　　功能：設置/獲取播放速度，范圍：-10 to 10

HRESULT SetVolume(USHORT usVolume);
HRESULT GetVolume(USHORT *pusVolume);

　　功能：設置/獲取播放音量，范圍：0 to 100

HRESULT SetSyncSpeakTimeout(ULONG msTimeout);
HRESULT GetSyncSpeakTimeout(ULONG *pmsTimeout);

　　功能：設置/獲取同步超時時間。由于在同步模式中，電泳Speak后程序就會進入阻塞狀態等待Speak返回，為免程序長時間沒相應，應該設置超時時間，msTimeout單位為毫秒。

HRESULT SetOutput(IUnknown *pUnkOutput,BOOL fAllowFormatChanges);

　　功能：設置輸出，下文會講到用SetOutput把Speak輸出問WAV文件。

　　這些函數的返回類型都是HRESULT，如果成功則返回S_OK，錯誤有各自不同的錯誤碼。

　　使用XML
引自: http://study.qqcf.com/web/198/22269.htm
　　個人認為這個TTS api功能最強大之處在于能夠分析XML標簽，通過XML標簽設置音量、音調、延長、停頓，幾乎可以使輸出達到自然語音效果。前面已經提過，把Speak參數dwFlags設為SPF_IS_XML,TTS引擎就會分析XML文本，輸入文本并不需要嚴格遵守W3C的標準，只要含有XML標簽就行了，下面舉個例子： ……

pVoice-＞Speak(L"＜VOICE REQUIRED=''NAME=Microsoft Mary''/＞volume＜VOLUME LEVEL=''100''＞turn up＜/VOLUME＞", SPF_IS_XML, NULL);
……
＜VOICE REQUIRED=''NAME=Microsoft Mary''/＞

　　標簽把聲音設為Microsoft Mary，英文版SDK中一共含有3種聲音，另外兩種是Microsoft Sam和Microsoft Mike。 ……

＜VOLUME LEVEL=''100''＞

　　把音量設為100，音量范圍是0～100。

　　另外：標志音調（-10～10）：＜P99vCH MIDDLE="10"＞text＜/P99vCH＞

　　注意：" 號在C/C++中前面要加 \ ，否則會出錯。

posted on 2009-08-29 07:29 逛奔的蝸牛閱讀(2503) 評論(0) 編輯收藏引用所屬分類: Qt

只有注冊用戶登錄后才能發表評論。
【推薦】100%開源！大型工業跨平臺軟件C++源碼提供，建模，組態！

相關文章: Qt：編碼范圍 Qt：Windows Qt 去掉選中的虛線框 Qt：定制qDebug等輸出的格式 Qt：給QWidget添加shadow效果 Qt：Q_DECLARE_METATYPE和qRegisterMetaType Qt：繪制帶高光的按鈕 Qt：FontMetrics Mac：Mac下安裝PHP, MySql開發環境 Qt：無標題欄無邊框程序的拖動和改變大小 Qt：Use Third Party Libraries

網站導航: 博客園 IT新聞 BlogJava 博問 Chat2DB 管理

逛奔的蝸牛

隨筆分類

搜索

最新評論