本文へ移動

スキャンからベトナム語の文字を認識する(OCR)

OCR は画像やスキャン内の文字を読み取ります。ベトナム語の認識モデルはあなたの端末上で動作し、ファイルは送信されません。

3 分4 ステップ

手順

  1. スキャンまたは画像を選ぶ「テキストOCR」を開き、スキャンした PDF ファイル、または JPG・PNG 画像を選びます。複数のファイルを選んで順番を変えることもできます。
  2. 出力の種類を選ぶ「検索可能な PDF」はページの見た目をそのまま保ち、検索(Ctrl+F)やコピー用の文字レイヤーを追加します。「テキスト (.txt)」は文字だけを取り出します。
  3. 「文字を認識」を押す初回は、ベトナム語の認識モデル(約 1.4 MB)をこのサイトから読み込みます。その後は1ページにつき数秒かかります。
  4. ダウンロードまたはコピーダウンロードした PDF は「<ファイル名> - OCR.pdf」という名前になります。テキスト版は「テキストの内容」欄に表示されるので、「コピー」を押して他の場所に貼り付けます。

コツ

  • まっすぐ撮った鮮明な画像で、文字が十分に大きいほど良い結果になります。
  • すでに文字レイヤーのあるページはスキップされ、再認識しません。
  • 画像1枚から文字を取り出すだけなら、「画像 → テキスト」のほうが速くて便利です。

注意点

  • 現在認識できるのはベトナム語のみです。
  • OCR は、特にぼやけた画像や手書き文字で読み間違えることがあります。使う前に確認してください。
  • 初回は認識モデルを読み込むためにネット接続が必要です。