C++ は Microsoft 独自の音声認識インターフェイスを呼び出して、すぐに使い始めることができます。-C#.Net チュートリアル-php.cn

ホームページ

バックエンド開発

C#.Net チュートリアル

C++ は Microsoft 独自の音声認識インターフェイスを呼び出して、すぐに使い始めることができます。

PHPz

Apr 03, 2017 am 11:31 AM

c++インターフェース音声認識

C++ 音声認識インターフェイス (Microsoft Speech SDK) のクイックスタート

私は最近、卒業プロジェクトで Microsoft の C++ 音声認識インターフェイスを使用し、多くの情報を検索し、多くの問題に遭遇し、多くの回り道をしました。。今、私は自分自身の経験を書き留めています。一つは自分自身を向上させるため、もう一つは社会への恩返しです。このブログを読んで、C++ 音声認識インターフェイスの実装方法を 5 分で習得できることを願っています。 (使用プラットフォームはwin8+VS2013です)

1. SDKをインストールします

MicrosoftSpeechPlatformSDK.msiをデフォルトのパスにインストールするだけです。
ダウンロードパス:
download.csdn.net/detail/michaelliang12/9510691

2. 新しいプロジェクトを作成し、環境を構成します

設定:
1、プロパティ – 構成プロパティ – C/C++ – 一般 – 追加のインクルードディレクトリ: C:Program FilesMicrosoft SDKsSpeechv11.0Include (特定のパスはインストールパスに関連しています)
2. プロパティ – 構成プロパティ – リンカー – 入力 – 追加の依存関係: sapi.lib; 3. 音声認識コード

テキスト変換は音声と音声テキストに分けることができます

1. 追加する必要があるヘッダーファイル:

#include <sapi.h> //导入语音头文件#pragma comment(lib,"sapi.lib") //导入语音头文件库

機能:

void  CBodyBasics::MSSSpeak(LPCTSTR speakContent)// speakContent为LPCTSTR型的字符串,调用此函数即可将文字转为语音{
    ISpVoice *pVoice = NULL;    //初始化COM接口

    if (FAILED(::CoInitialize(NULL)))
        MessageBox(NULL, (LPCWSTR)L"COM接口初始化失败！", (LPCWSTR)L"提示", MB_ICONWARNING | MB_CANCELTRYCONTINUE | MB_DEFBUTTON2);    //获取SpVoice接口

    HRESULT hr = CoCreateInstance(CLSID_SpVoice, NULL, CLSCTX_ALL, IID_ISpVoice, (void**)&pVoice);    if (SUCCEEDED(hr))
    {
        pVoice->SetVolume((USHORT)100); //设置音量，范围是 0 -100
        pVoice->SetRate(2); //设置速度，范围是 -10 - 10
        hr = pVoice->Speak(speakContent, 0, NULL);

        pVoice->Release();

        pVoice = NULL;
    }    //释放com资源
    ::CoUninitialize();
}

2. これは少し面倒ですが、マイクはリアルタイムで監視する必要があり、Windows メッセージメカニズムが関与するためです。

(1) まずプロジェクトのプロパティを設定します:

プロパティ – 構成プロパティ – C/C++ – プリプロセッサ – プリプロセッサ定義: _WIN32_DCOM; (2) 追加する必要があるヘッダーファイル:

#include <sapi.h> //导入语音头文件#pragma comment(lib,"sapi.lib") //导入语音头文件库#include //语音识别头文件#include //要用到CString#pragma onceconst int WM_RECORD = WM_USER + 100;//定义消息

(3) プログラム内で定義します。 .h ヘッダーファイル内の変数

//定义变量CComPtr<ISpRecognizer>m_cpRecoEngine;// 语音识别引擎(recognition)的接口。CComPtr<ISpRecoContext>m_cpRecoCtxt;// 识别引擎上下文(context)的接口。CComPtr<ISpRecoGrammar>m_cpCmdGrammar;// 识别文法(grammar)的接口。CComPtr<ISpStream>m_cpInputStream;// 流()的接口。CComPtr<ISpObjectToken>m_cpToken;// 语音特征的(token)接口。CComPtr<ISpAudio>m_cpAudio;// 音频(Audio)的接口。(用来保存原来默认的输入流)ULONGLONG  ullGrammerID;

(4) 音声認識初期化関数を作成します (プログラムの最初の実行開始時に呼び出されます。たとえば、記事の最後にあるサンプルコードでは、この初期化関数を応答コードに置きます)ダイアログボックスの初期化メッセージ WM_INITDIALOG)

//语音识别初始化函数void  CBodyBasics::MSSListen()
{    //初始化COM接口

    if (FAILED(::CoInitialize(NULL)))
        MessageBox(NULL, (LPCWSTR)L"COM接口初始化失败！", (LPCWSTR)L"提示", MB_ICONWARNING | MB_CANCELTRYCONTINUE | MB_DEFBUTTON2);


    HRESULT hr = m_cpRecoEngine.CoCreateInstance(CLSID_SpSharedRecognizer);//创建Share型识别引擎
    if (SUCCEEDED(hr))
    {


        hr = m_cpRecoEngine->CreateRecoContext(&m_cpRecoCtxt);//创建识别上下文接口

        hr = m_cpRecoCtxt->SetNotifyWindowMessage(m_hWnd, WM_RECORD, 0, 0);//设置识别消息

        const ULONGLONG ullInterest = SPFEI(SPEI_SOUND_START) | SPFEI(SPEI_SOUND_END) | SPFEI(SPEI_RECOGNITION);//设置我们感兴趣的事件
        hr = m_cpRecoCtxt->SetInterest(ullInterest, ullInterest);

        hr = SpCreateDefaultObjectFromCategoryId(SPCAT_AUDIOIN, &m_cpAudio);
        m_cpRecoEngine->SetInput(m_cpAudio, true);        //创建语法规则
        //dictation听说式
        //hr = m_cpRecoCtxt->CreateGrammar(GIDDICTATION, &m_cpDictationGrammar);
        //if (SUCCEEDED(hr))
        //{
        //  hr = m_cpDictationGrammar->LoadDictation(NULL, SPLO_STATIC);//加载词典
        //}

        //C&C命令式，此时语法文件使用xml格式
        ullGrammerID = 1000;
        hr = m_cpRecoCtxt->CreateGrammar(ullGrammerID, &m_cpCmdGrammar);

        WCHAR wszXMLFile[20] = L"";//加载语法
        MultiByteToWideChar(CP_ACP, 0, (LPCSTR)"CmdCtrl.xml", -1, wszXMLFile, 256);//ANSI转UNINCODE
        hr = m_cpCmdGrammar->LoadCmdFromFile(wszXMLFile, SPLO_DYNAMIC);        //MessageBox(NULL, (LPCWSTR)L"语音识别已启动！", (LPCWSTR)L"提示", MB_CANCELTRYCONTINUE );
        //激活语法进行识别
        //hr = m_cpDictationGrammar->SetDictationState(SPRS_ACTIVE);//dictation
        hr = m_cpCmdGrammar->SetRuleState(NULL, NULL, SPRS_ACTIVE);//C&C
        hr = m_cpRecoEngine->SetRecoState(SPRST_ACTIVE);

    }    else
    {
        MessageBox(NULL, (LPCWSTR)L"语音识别引擎启动出错！", (LPCWSTR)L"警告", MB_OK);        exit(0);
    }    //释放com资源
    ::CoUninitialize();    //hr = m_cpCmdGrammar->SetRuleState(NULL, NULL, SPRS_INACTIVE);//C&C}

(5) 定義されたメッセージ処理関数

は、他のメッセージ処理コードと一緒に配置する必要があります。たとえば、この記事のコードでは、DlgProc の最後に配置されています。記事の最後にあるサンプルコードの () 関数。この記事の他のコードブロック全体は直接コピーできます。変更する必要があるのは、次の

メッセージ応答モジュール

//消息处理函数USES_CONVERSION;
    CSpEvent event;    if (m_cpRecoCtxt)
    {        while (event.GetFrom(m_cpRecoCtxt) == S_OK){            switch (event.eEventId)
            {            case SPEI_RECOGNITION:
            {                                     //识别出了语音
                                     m_bGotReco = TRUE; 

                                     static const WCHAR wszUnrecognized[] = L"<Unrecognized>";

                                     CSpDynamicString dstrText;                                     ////取得识别结果 
                                     if (FAILED(event.RecoResult()->GetText(SP_GETWHOLEPHRASE, SP_GETWHOLEPHRASE, TRUE, &dstrText, NULL)))
                                     {
                                         dstrText = wszUnrecognized;
                                     }

                                     BSTR SRout;
                                     dstrText.CopyToBSTR(&SRout);
                                     CString Recstring;
                                     Recstring.Empty();
                                     Recstring = SRout;                                    //做出反应（*****消息反应模块*****）
                                    if (Recstring == "发短信")
                                     {                                         //MessageBox(NULL, (LPCWSTR)L"好的", (LPCWSTR)L"提示", MB_OK);
                                         MSSSpeak(LPCTSTR(_T("好，马上发短信！")));

                                     }                                     else if (Recstring == "李雷")
                                     {
                                         MSSSpeak(LPCTSTR(_T("好久没看见他了，真是 long time no see")));
                                     }   

            }                break;
            }
        }
    }

(6) 文法ファイルを変更する

CmdCtrl.xml ファイルを変更することだけです。これにより、特定のメッセージの認識が向上します。語彙の認識効果が大幅に向上します（人の名前など）。 (なお、exeを単独で実行する場合は、このファイルもexeと同じフォルダに置く必要があります。置かないとエラーにはなりませんが、文法ファイルの語彙認識効果が悪くなります) )

りー

以上がC++ は Microsoft 独自の音声認識インターフェイスを呼び出して、すぐに使い始めることができます。の詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

声明

この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。

汎用性のある.NET言語としてのC＃：アプリケーションと例Apr 26, 2025 am 12:26 AM

C＃は、エンタープライズレベルのアプリケーション、ゲーム開発、モバイルアプリケーション、Web開発で広く使用されています。 1）エンタープライズレベルのアプリケーションでは、C＃がasp.netcoreにWebAPIを開発するためによく使用されます。 2）ゲーム開発では、C＃がUnityエンジンと組み合わされて、ロールコントロールやその他の機能を実現します。 3）C＃は、コードの柔軟性とアプリケーションのパフォーマンスを改善するために、多型と非同期プログラミングをサポートします。

Web、デスクトップ、モバイル開発用のC＃.NETApr 25, 2025 am 12:01 AM

C＃と.NETは、Web、デスクトップ、モバイル開発に適しています。 1）Web開発では、ASP.Netcoreがクロスプラットフォーム開発をサポートしています。 2）デスクトップ開発では、さまざまなニーズに適したWPFとWINFORMSを使用します。 3）モバイル開発は、Xamarinを介したクロスプラットフォームアプリケーションを実現します。

C＃.NETエコシステム：フレームワーク、ライブラリ、およびツールApr 24, 2025 am 12:02 AM

C＃.NETエコシステムは、開発者がアプリケーションを効率的に構築できるようにするための豊富なフレームワークとライブラリを提供します。 1.ASP.NETCOREは、高性能Webアプリケーションの構築に使用されます。2.EntityFrameWorkCoreは、データベース操作に使用されます。これらのツールの使用とベストプラクティスを理解することにより、開発者はアプリケーションの品質とパフォーマンスを向上させることができます。

azure/awsへのc＃.netアプリケーションの展開：ステップバイステップガイドApr 23, 2025 am 12:06 AM

c＃.netアプリをAzureまたはAWSに展開する方法は？答えは、AzureAppServiceとAwselasticBeanStalkを使用することです。 1。Azureでは、AzureAppServiceとAzurePipelinesを使用して展開を自動化します。 2。AWSでは、Amazon ElasticBeanstalkとAwslambdaを使用して、展開とサーバーレス計算を実装します。

C＃.NET：強力なプログラミング言語の紹介Apr 22, 2025 am 12:04 AM

C＃と.NETの組み合わせにより、開発者に強力なプログラミング環境を提供します。 1）C＃は、多型と非同期プログラミングをサポートします。2）.NETは、クロスプラットフォーム機能と同時処理メカニズムを提供し、デスクトップ、Web、モバイルアプリケーション開発で広く使用されています。

.NETフレームワーク対C＃：用語のデコードApr 21, 2025 am 12:05 AM

.NetFrameworkはソフトウェアフレームワークであり、C＃はプログラミング言語です。 1..netframeworkは、デスクトップ、Web、モバイルアプリケーションの開発をサポートするライブラリとサービスを提供します。 2.C＃は.NetFrameWork用に設計されており、最新のプログラミング機能をサポートしています。 3..NetFrameworkはCLRを介してコード実行を管理し、C＃コードはILにコンパイルされ、CLRによって実行されます。 4. .NetFrameWorkを使用してアプリケーションをすばやく開発し、C＃はLINQなどの高度な関数を提供します。 5.一般的なエラーには、タイプ変換と非同期プログラミングデッドロックが含まれます。 VisualStudioツールは、デバッグに必要です。

C＃.NETの分解：初心者の概要Apr 20, 2025 am 12:11 AM

C＃は、Microsoftが開発した最新のオブジェクト指向プログラミング言語であり、.NETはMicrosoftが提供する開発フレームワークです。 C＃は、CのパフォーマンスとJavaのシンプルさを組み合わせており、さまざまなアプリケーションの構築に適しています。 .NETフレームワークは、複数の言語をサポートし、ガベージコレクションメカニズムを提供し、メモリ管理を簡素化します。

C＃と.NETランタイム：それらがどのように連携するかApr 19, 2025 am 12:04 AM

C＃と.NETランタイムは密接に連携して、開発者に効率的で強力なプラットフォームの開発機能に力を与えます。 1）C＃は、.NETフレームワークとシームレスに統合するように設計されたタイプセーフおよびオブジェクト指向のプログラミング言語です。 2）.NETランタイムは、C＃コードの実行を管理し、ガベージコレクション、タイプの安全性、その他のサービスを提供し、効率的でクロスプラットフォームの操作を保証します。

See all articles