トップページ -> 最新情報技術の実習と研究ツール -> スピーチ -> Python の SpeechRecognizer を用いて音声認識
サイトマップへ]

Python の SpeechRecognizer を用いて音声認識

金子邦彦研究室: データベース、人工知能(AI)、データサイエンスの融合により不可能を可能にする
Python の SpeechRecognizer (https://github.com/Uberi/speech_recognition) を用いて音声認識

先人に感謝

キーワード: 音声認識, Google API, Python, SpeechRecognition


前もって準備しておくこと

前準備として,Anaconda のインストールが終わっていること. 手順を下に説明しています.

Anaconda のインストール

Python 3 の開発環境である Anacondaをおすすめ.Window でのインストール手順は次の通りです(Linuxでも同様の手順です).

  1. https://www.anaconda.com/downloadを開く

  2. 「Download」をクリックする.

  3. ダウンロードが始まるので確認する.

  4. ダウンロードした .exe ファイルを実行して,Anacondaをインストール.

Python のパッケージ SpeechRecognition, pyaudio のインストール

Anaconda プロンプトを管理者として開き,次のコマンドを実行.

conda install -c conda-forge SpeechRecognition

引き続き,次のコマンドを実行

pip install pyaudio

Python の SpeechRecognizer を用いて音声認識してみる

  1. まずは,入った .wav ファイルを準備する

    ※ 手元に .wav ファイルがないよ,というときは http://www.wavsource.com(インターネットでは,下品な広告が付いている可能性があるので,必要もないのにクリックしないこと) などから入手できる(.wav ファイルをダウンロードするときは、利用条件などを確認すること)

  2. 「IPython シェル」を使う.

    ※ Anacondaに入っている開発環境 spyder を実行し,右下の ipython コンソールを使うのが簡単.

  3. 「IPython シェル」でカレントディレクトリの確認
    pwd()

    実行結果例

  4. 先ほどの .wav ファイルはカレントディレクトリに移しておく(あとの作業を楽にするため)

  5. 英語の音声認識してみる

    「IPython シェル」を使う.

    ※ Anacondaに入っている開発環境 spyder を実行し,右下の ipython コンソールを使うのが簡単.

    次の Python プログラムを実行

    「"coincidence.wav" 」のところは,ファイル名を書き換えること.

    import speech_recognition
    r = speech_recognition.Recognizer()
    with speech_recognition.AudioFile("coincidence.wav") as source:
        audio = r.record(source)
    r.recognize_google(audio)
    

    実行結果の例

  6. 日本語の音声認識をしたい場合には「language='ja-JP'」を指定する

    次の Python プログラムを実行

    「"1.wav" 」のところは,ファイル名を書き換えること.

    import speech_recognition
    r = speech_recognition.Recognizer()
    with speech_recognition.AudioFile("1.wav") as source:
        audio = r.record(source)
    r.recognize_google(audio, language='ja-JP')
    

    実行結果の例