跳到正文

从扫描件中识别越南语文字(OCR)

OCR 可读取图片和扫描件中的文字。越南语识别模型直接在你的设备上运行;文件不会发送出去。

3 分钟4 个步骤

步骤

  1. 选择扫描件或图片打开“OCR 文字识别”,选择扫描的 PDF 文件或 JPG、PNG 图片。可选择多个文件并调整顺序。
  2. 选择输出类型“可搜索文字的 PDF”保持页面原样,并添加文字层以便搜索(Ctrl+F)和复制。“纯文本(.txt)”只提取文字部分。
  3. 点击“识别文字”第一次使用时,工具会从本网站下载越南语识别模型(约 1.4 MB)。之后每页需要几秒钟。
  4. 下载或复制下载的 PDF 命名为“<文件名> - OCR.pdf”。纯文本会显示在“文字内容”框中;点击“复制”即可粘贴到其他地方。

小贴士

  • 正面拍摄、清晰、字号足够大的照片识别效果最好。
  • 已有文字层的页面会被跳过,不会重复识别。
  • 只需要从一张照片中提取文字:使用“图片 → 文字”更快。

注意事项

  • 目前只识别越南语。
  • OCR 可能识别错误,尤其是模糊的照片或手写字。使用前请仔细核对。
  • 第一次使用需要联网下载识别模型。