ShotEasy
PaddleOCR · 本地处理

OCR 文字识别与 PDF 编辑器

识别、校对、预览、导出,全程只在你的浏览器中完成

🔒

文件不上传

图片、PDF 页面和识别文字仅保存在当前浏览器内存中。

✍️

逐行校对

结合检测框和置信度检查并修改每一行识别结果。

📄

可搜索 PDF

保留扫描页原貌,同时加入可选择、可搜索的文字层。

PP-OCRv5 · WebAssembly · ONNX Runtime

由 PaddleOCR.js 驱动的浏览器 OCR

本工具使用官方 @paddleocr/paddleocr-js SDK,在浏览器中运行 PP-OCRv5 文字检测与识别产线。导入图片或扫描 PDF 后,它会定位文字区域、识别每一行,并允许你在生成 PDF 前修正结果。

本地 OCR 如何工作

1

PP-OCRv5 识别产线

PaddleOCR.js 组合文字检测与文字识别,结果包含文本、文字框多边形坐标和置信度。

2

WASM 本地推理

SDK 内部管理 OpenCV.js 与 ONNX Runtime,通过 WebAssembly 在设备上推理,无需把文档像素发送给 OCR 服务器。

3

模型浏览器缓存

首次使用会下载 OCR 模型与 WASM 运行资源,浏览器缓存后再次识别通常更快。

4

隐私文档流程

工具只下载公开模型和运行资源,你选择的文件与修改后的文字不会被上传。

把扫描件转换为可搜索 PDF

  1. 1

    选择一个文件

    打开 JPG、PNG、WebP、BMP 或扫描 PDF。

  2. 2

    自动开始 OCR

    文件在本地完成解析,随后自动识别文字。

  3. 3

    检查与校对

    在页面文字框或全文视图中修改识别结果。

  4. 4

    导出 PDF

    下载保留原始页面并带可搜索文字层的 PDF。

OCR 与可搜索 PDF 常见问题

ShotEasy 会上传我的文档吗?

不会。文档图片、PDF 页面和识别文字都留在浏览器中;仅在需要时下载公开 OCR 模型、WASM 运行资源和导出字体。

为什么第一次 OCR 比较慢?

首次运行需要初始化 OpenCV.js 与 ONNX Runtime,并下载 PP-OCRv5 模型;缓存完成后再次识别通常更快。

识别错误可以修改吗?

可以。每个检测到的文字行都能编辑,可直接在页面上修改,也可使用全文编辑视图。

导出的 PDF 为什么可以搜索?

ShotEasy 根据校对后的 OCR 文字在原扫描页面上加入文本层,兼容的 PDF 阅读器可搜索和选择这些文字。

我们重视你的隐私

你的照片不会被上传,图片编辑都在你的浏览器中进行。