無料で音声をテキストに書き写す方法
ボイスメモ、会議の録音、または口述メモをテキストに変換する必要がありますか?ブラウザーで実行できます。購読もアップロードもプライバシーのリスクもありません。
なぜブラウザベースの文字起こしをするのでしょうか?
Otter.ai、Rev、Trint などの人気の文字起こしサービスでは、音声をクラウド サーバーにアップロードする必要があります。これにより、次のようないくつかの問題が発生します。
- プライバシーのリスク— あなたの会話、医療記録、法的口述筆記が他人のサーバーに保存されている
- 料金— ほとんどのサービスは、月単位のサブスクリプションまたは分単位の料金を請求します。
- 遅れ— アップロード + 処理 + ダウンロードに時間がかかります
- アカウントが必要です— アカウントを作成し、利用規約に同意する必要があります
Web Speech API の仕組み
最新のブラウザには、ウェブスピーチAPI。何が起こるかというと、次のとおりです。
- ブラウザへのマイクアクセスを許可します
- オペレーティング システムの音声エンジンが音声を処理します (Windows 音声認識、macOS ディクテーション、Android 音声サービス)
- 転写されたテキストはリアルタイムで Web ページにストリーミングされます。
- Presend のサーバーには何も送信されません - パイプライン全体がローカルです
サポートされている言語
言語サポートはブラウザとオペレーティング システムによって異なります。ほとんどのシステムは以下をサポートしています。
- 英語 (米国、英国、オーストラリア、インド)
- フランス語、スペイン語、ドイツ語、イタリア語、ポルトガル語
- 日本語、韓国語、中国語(簡体字・繁体字)
- アラビア語、ヒンディー語、ロシア語、オランダ語、ポーランド語、トルコ語
言語が利用できない場合、ブラウザはサポートされている最も近い言語にフォールバックします。
精度のためのベストプラクティス
- 良いマイクを使う— ラップトップの内蔵マイクも機能しますが、USB ヘッドセットまたは専用マイクを使用すると精度が大幅に向上します
- 背景ノイズを最小限に抑える— 静かな部屋ではより鮮明なトランスクリプトが作成されます
- はっきりと話す— 一貫した音量を発音し維持する
- 文と文の間で一時停止する— エンジンがテキストを正しくセグメント化するのに役立ちます
- 句読点をチェックする— API は句読点を自動的に挿入しますが、編集が必要な場合があります。
制限事項
- Firefox音声認識はサポートしていません (合成のみ)。 Chrome、Edge、または Safari を使用してください。
- 長いセッション一部のブラウザでは 60 秒後にタイムアウトする場合があります。この問題が発生した場合は、単純に再起動してください。
- アクセントと方言あまり一般的ではないバリアントの精度が低下する可能性があります。
- 専門用語(医療、法律、技術)後編集が必要な場合があります。
ステップバイステップのガイド
- ツールを開く— に移動音声からテキストへの変換
- 言語を選択してください— ドロップダウン メニューから選択します
- 「リスニングを開始」をクリックします— プロンプトが表示されたらマイクへのアクセスを許可します
- 自然に話す— 話すとテキストが表示されます
- 「停止」をクリックします終わったら
- コピーまたはダウンロード— .txt ファイルとして保存するか、クリップボードにコピーします