Pythonでテキストを音声に変換する方法【gTTSの使い方を徹底解説】
テキスト読み上げ(Text to Speech)とは、テキストを入力として与えると、その内容を音声として出力してくれるプログラムのことです。
Pythonでは、APIを利用することで簡単にテキスト読み上げ機能を実装できます。代表的なAPIの一つが「Google Text to Speech API」、通称 gTTS です。gTTSを使えば、指定したテキストを音声に変換し、その結果をオーディオファイルとして保存することができます。
ステップ1:gTTSをインストールする
gTTSを利用するには、まずインストールが必要です。インストール方法はとても簡単です。
ターミナル(コマンドプロンプト)を開き、以下のコマンドを実行してください。
pip install gTTS
このコマンドを実行すると、gTTSがインストールされます。
ステップ2:テキスト読み上げプログラムを作成する
次に、実際にテキストを音声へ変換するプログラムを書いていきます。基本的な流れは以下の通りです。
gTTSをインポートします。
変換したいテキストを指定します。
gTTS()関数を呼び出します。この関数は主に3つのパラメータを受け取ります。
text:音声に変換したい入力テキストです。
language:音声化する言語を指定します。gTTSは英語・日本語・フランス語・ドイツ語・ヒンディー語など、多数の言語に対応しています。
slow:音声の再生速度を指定するブール値(True / False)です。Trueを指定するとゆっくりとした読み上げになり、Falseを指定すると通常の速さで読み上げられます。
gTTS()の実行結果は変数に返されます。この出力はMP3ファイルとして保存できます。
保存した音声を再生したい場合は、
os.system()を利用します。そのためにosモジュールをインポートし、保存したオーディオファイル名を引数として渡せば再生できます。
サンプルコード
実際のコード例を見てみましょう。
from gtts import gTTS
myText = "I want to learn Python"
speech = gTTS(text=myText, lang="en", slow=False)
speech.save("tts.mp3")このコードでは、「I want to learn Python」という英語のテキストを通常の速さで音声化し、「tts.mp3」というファイル名で保存しています。
生成した音声を再生するには
保存した音声ファイルをすぐに再生したい場合は、以下のように os モジュールを組み合わせます。
import os
from gtts import gTTS
myText = "I want to learn Python"
speech = gTTS(text=myText, lang="en", slow=False)
speech.save("tts.mp3")
os.system("tts.mp3")なお、日本語のテキストを読み上げたい場合は、lang="ja" を指定するだけで対応できます。ぜひいろいろな言語や文章で試してみてください。
-
【Python】Tkinterでラベルのテキストを削除する方法をわかりやすく解説
Tkinterは、PythonでGUIベースのアプリケーションを作成・開発するための標準ライブラリです。この記事では、何らかのテキストが表示されているラベルから、そのテキストを削除する方法を解説します。 ラベルからテキストを削除するには、ラベルの表示を切り替えるトリガーとして機能するボタンを作成します。具体的には、config()メソッドを使ってラベルのtext属性を空の文字列に書き換えます。 サンプルコード # Tkinterライブラリをインポート from tkinter import * # tkinterフレームのインスタンスを作成 win = Tk() # ウィンドウのサイズを
-
Windowsで音声をテキストに変換する3つの方法|音声入力・文字起こしを簡単に実現
長文のドキュメントやメールをキーボードで入力するのは、時間も手間もかかって大変です。そこで便利なのが「音声入力」です。声で話すだけでテキスト化できるため、疲れにくく、入力スピードも格段に向上します。Windowsには標準の音声認識機能が搭載されているほか、オンラインツールやサードパーティ製アプリを活用すれば、誰でも簡単に音声をテキストへ変換できます。本記事では、その具体的な方法を3つご紹介します。 1. Windows標準の「ディクテーション」機能を使う Windows 10以降には、音声をテキストに変換する「ディクテーション(音声入力)」機能が標準搭載されています。音声認識エンジンによって声