書類をスキャンして整える
ページの写真をきれいなスキャンに変え、そこから文字を取り出します。画像はこのブラウザータブ内で処理され、アップロードされません。
仕組み
スマートフォンで撮ったページの写真は、きれいな「スキャン」になることはまずありません。全体が灰色がかり、照明はむらがあり、文字は選択もできません。このツールはその両方を解決します。補正の処理で、グレースケール・コントラスト強調・本物の白黒といった鮮明な結果に変換し、光学文字認識(OCR)がページから文字を読み取ります。
補正は端末上で即座に実行されます。初めて文字を抽出するときに英語の認識パック(数メガバイト)がダウンロードされてキャッシュされ、それ以降は OCR もオフラインで動作します。画像と認識された文字はブラウザー内にとどまり、アップロードされることはありません。
抽出された文字は編集できるので、ダウンロードする前に細かい誤りを直せます。
使い方
- 1 ページの写真を選びます。
- 2 補正を選びます。文字には「白黒」が最も適しています。
- 3 整えた画像をダウンロードするか、「文字を抽出」を押して OCR を実行します。
- 4 必要に応じて認識された文字を直し、.txt ファイルとしてダウンロードします。
知っておくと便利なこと
- 初回の文字抽出で英語パックをダウンロードします。以降は OCR もオフラインで動作します。
- 平らで明るく、ピントが合っていて、ページに合わせて切り取られた写真が最良の結果になります。
- 白黒の補正は、認識エンジンにとって最もきれいな入力になることが多いです。
- 画像と文字はブラウザー内にとどまり、アップロードされません。
よくある質問
書類の写真を編集できる文字にするには?
書類の写真を選び、補正(文字には「白黒」が最適)を選んで、「文字を抽出」を押してください。
OCR はオフラインでも動きますか?
初回に英語の言語パックをダウンロードした後であれば動きます。以降の認識は接続なしでローカルに実行されます。
書類はサーバーへアップロードされますか?
いいえ。補正も文字認識も、どちらもブラウザータブの中で行われます。
OCR の精度を上げるには?
平らで明るく、ピントが合っていて、ページに合わせて切り取られた写真です。白黒の補正は認識エンジンにとって最もきれいな入力になることが多いです。
抽出した文字は編集できますか?
はい。編集できる入力欄に表示されるので、直してから .txt ファイルとしてダウンロードできます。
関連ツール
ファイルは端末上で処理され、アップロードされません。ブラウザーの開発者ツールの「ネットワーク」タブでご確認いただけます。