← スクリーンショットをテキストに変換

画像やスクリーンショットからテキストを抽出する方法

スクリーンショットからテキストをコピーしたり、文書をスキャンしたり、印刷されたページをデジタル化したりする必要がありますか? OCR テクノロジーにより、それが瞬時に行われます。Presend を使用すると、ブラウザ内ですべてが行われます。

OCRとは何ですか?

OCR (光学文字認識) は、テキストの画像を機械可読テキストに変換するテクノロジーです。これにより、次のことが可能になります。

クラウド OCR のプライバシー リスク

ほとんどの OCR サービス (Google Vision、Azure Computer Vision、Amazon Textract) では、画像をクラウドにアップロードする必要があります。これは次の場合に問題になります。

ファイルをすぐに削除すると主張するサービスであっても、依然としてインフラストラクチャ上でファイルを処理しており、監査証跡が作成され、漏洩の可能性があります。

Tesseract.js の仕組み

Tesseract.jsは、Google の Tesseract OCR エンジンの純粋な JavaScript ポートであり、WebAssembly にコンパイルされています。完全にブラウザ内で実行されます。

  1. 言語モデル (traineddata) は言語ごとに 1 回ダウンロードされます (英語の場合は最大 4MB)。
  2. 画像は CPU または GPU を使用してローカルで処理されます
  3. 認識されたテキストは Web ページに直接返されます。
  4. 外部サーバーには何も送信されません

Tesseract は、Google ブックス、Google 翻訳のカメラ機能、および無数のドキュメント スキャン アプリを動かしているエンジンと同じです。サポートします100以上の言語アラビア語、中国語、日本語、デヴァナーガリー文字、キリル文字などの文字が含まれます。

サポートされている入力方法

精度のヒント

ユースケース

ステップバイステップのガイド

  1. ツールを開く— に移動スクリーンショットをテキストに変換
  2. 言語を選択してください— 画像内のテキストの言語を選択します
  3. アップロードまたは貼り付け— 画像をドラッグするか、クリックして選択するか、Ctrl+V を押してクリップボードから貼り付けます
  4. 認識されるまで待ちます— 画像サイズによっては処理に数秒かかります
  5. レビューと編集— 抽出されたテキストにエラーがないか確認します
  6. コピーまたはダウンロード— .txt ファイルとして保存するか、クリップボードにコピーします

制限事項

スクリーンショットをテキストに開く→