無料でテキストを音声に変換する方法
エッセイを校正したり、通勤中に記事を聞いたり、ナレーションを作成したりする必要がありますか?ブラウザーはあらゆるテキストを読み上げることができます。購読やアップロード、デバイスからのデータの送信は必要ありません。
なぜブラウザベースのテキスト読み上げなのか?
Amazon Polly、Google Cloud Text-to-Speech、または Celebrities などのクラウド TTS サービスは優れた結果をもたらしますが、次のことが必要です。
- テキストをサーバーにアップロードする
- APIキーと開発者アカウント
- キャラクターごとまたは分ごとに支払う
- データのトレーニングを許可する条件に同意する
個人的な使用、下書き、または機密性の高いコンテンツの場合、ブラウザベースの TTS は高速かつ無料で、完全にプライベートです。
音声合成の仕組み
のWeb Speech API の speechSynthesis インターフェイス最新のすべてのブラウザに組み込まれています。オペレーティング システムの音声を使用します。
- 窓— Microsoft David、Zira、その他のシステムボイス
- macOS— 高品質の Siri の声 (アレックス、サマンサなど)
- Linux— ディストリビューションに応じて、espeak、Festival、または Piper
- アンドロイド/iOS— 地域アクセントを備えたデバイスネイティブの TTS エンジン
テキストはすべてデバイス上で処理されます。コンテンツを伝送するネットワーク リクエストはありません。
ユースケース
- 校正— 自分の書いた文章が読み上げられるのを聞くと、目が見逃していた間違いを見つけることができます
- アクセシビリティ— 読むのが難しい場合は、記事、電子メール、または文書を聞いてください。
- 語学学習— 外国語のテキストの発音を聞く
- コンテンツ制作— ビデオまたはプレゼンテーション用の素早いナレーションの下書き
- マルチタスク— 料理中、運動中、通勤中に聞くことができます
音声設定を調整する
Presend のツールを使用すると、以下を制御できます。
- 声— システムにインストールされているすべての音声から言語ごとにグループ化して選択します
- スピード— 0.5× (遅い) から 2.0× (速い) まで。 1.0倍は自然な会話のペースです
- ピッチ— 高い音または低い音。コンテンツの雰囲気を強調したり一致させたりするのに役立ちます
ステップバイステップのガイド
- ツールを開く— に移動テキスト読み上げ
- テキストを貼り付けます— 最大数千文字を入力または貼り付けます
- 声を選択してください— 言語と特定の音声を選択します
- スピードとピッチを調整する— 好みに合わせて微調整
- 「話す」をクリックします— すぐに聞くことができます
- 一時停止/停止を使用する— 必要に応じて再生を制御します
出力の記録
ほとんどのブラウザは、セキュリティ サンドボックスのため、合成オーディオを直接キャプチャできません。 TTS 出力を音声ファイルとして保存するには、オペレーティング システムのスクリーン レコーダーと音声キャプチャを使用します。
- 窓— Xbox ゲーム バー (Win+G) または OBS Studio
- macOS— QuickTime Player (ファイル > 新しいオーディオ録音) または Cmd+Shift+5
- Linux— OBS Studio または ffmpeg を使用した parec