|
|
金子邦彦研究室: データベース、人工知能(AI)、データサイエンスの融合により不可能を可能にする |
先人に感謝
キーワード: 音声認識, Google API, Python, SpeechRecognition
前準備として,Anaconda のインストールが終わっていること. 手順を下に説明しています.
Python 3 の開発環境である Anacondaをおすすめ.Window でのインストール手順は次の通りです(Linuxでも同様の手順です).
Anaconda プロンプトを管理者として開き,次のコマンドを実行.
conda install -c conda-forge SpeechRecognition
引き続き,次のコマンドを実行
pip install pyaudio
※ 手元に .wav ファイルがないよ,というときは http://www.wavsource.com(インターネットでは,下品な広告が付いている可能性があるので,必要もないのにクリックしないこと) などから入手できる(.wav ファイルをダウンロードするときは、利用条件などを確認すること)
※ Anacondaに入っている開発環境 spyder を実行し,右下の ipython コンソールを使うのが簡単.
pwd()
実行結果例
「IPython シェル」を使う.
※ Anacondaに入っている開発環境 spyder を実行し,右下の ipython コンソールを使うのが簡単.
次の Python プログラムを実行
「"coincidence.wav" 」のところは,ファイル名を書き換えること.
import speech_recognition
r = speech_recognition.Recognizer()
with speech_recognition.AudioFile("coincidence.wav") as source:
audio = r.record(source)
r.recognize_google(audio)
実行結果の例
次の Python プログラムを実行
「"1.wav" 」のところは,ファイル名を書き換えること.
import speech_recognition
r = speech_recognition.Recognizer()
with speech_recognition.AudioFile("1.wav") as source:
audio = r.record(source)
r.recognize_google(audio, language='ja-JP')
実行結果の例