图片留在本地,文字带得走

看得见的文字,
现在可以复制。

粘贴截图,或上传图片与扫描版 PDF。识别中文、英文和数字,整理后直接复制或下载。

LOCAL OCR

图片 / PDF 文字识别

文件不会上传

INPUT PAGES

待处理页面

尚未添加文件
+等待图片或 PDF

你可以连续添加多个文件。

01截图直接粘贴

不必先保存文件,复制截图后在页面任意位置粘贴即可。

02扫描 PDF 分页识别

自动渲染每一页,也会优先读取 PDF 已有的可选文字。

03本地识别更安心

OCR 引擎和语言模型都在浏览器运行,文件不会发送到服务器。

先判断是否需要 OCR,再决定是否压缩

先在原 PDF 中尝试选择文字,已有可搜索文字时应保留原件。扫描件可用练习页面检查编号、金额 123.45 和 O/0 等相似字符;OCR 结果需要对照原图逐项核对。

查看案例、样本与具体规则 →
OCR 准确率指南

先把原稿处理清楚,再决定能否信任识别结果

OCR 是把可见字形转换为可编辑文字,并不保证完全准确。端正、清晰、语言选择正确和人工复核,比简单重复识别更重要。

01 · 使用步骤

使用步骤

  1. 使用最清晰的来源

    尽量使用原始扫描件或照片,裁掉无关边框,校正倾斜,避免阴影,并确认小字没有因对焦或压缩而模糊。

  2. 选择对应语言

    识别语言应与页面一致。中英文混排会增加处理时间,也更容易混淆相似字母、汉字、数字和标点。

  3. 逐页人工复核

    重点对照姓名、日期、金额、小数点、账号、表格和换行,不要一次性接受未经检查的大段输出。

  4. 把结果当作工作副本

    下载纯文字后继续编辑,并保留原图片或 PDF。涉及法律、医疗、学术或财务信息时,OCR 结果只能作为草稿。

02 · 选择参考

选择参考

清晰扫描件
文字水平、对比度高且字号足够时,通常最容易得到稳定结果。
手机拍照
光线均匀、相机与纸面平行、没有手指遮挡和书页弯曲时效果更好。
扫描 PDF
需要逐页渲染后再识别,长文档会消耗更多时间和设备内存。
手写与表格
难度高于普通印刷段落,经常需要人工校正或更专业的识别流程。
03 · 重要限制

重要限制

  • OCR 可能混淆 O 与 0、l 与 1 以及外形相似的标点和汉字。
  • 复杂表格、多栏排版、印章、手写内容和低对比背景可能丢失阅读顺序。
  • 识别质量受原稿限制,放大模糊图片无法恢复没有拍到的真实细节。
  • 使用或分享重要数值前,必须回到原文逐项核对。
04 · 常见问题

常见问题

为什么姓名和数字更容易识别错?

识别依赖字形和上下文;专有名词、代码和孤立数字的上下文较少,因此更需要人工检查。

很模糊的照片还能恢复文字吗?

可能识别出部分内容,但锐化和放大不能补回原本没有记录的细节,重新扫描或拍照更可靠。

文档会上传吗?

不会。识别使用当前设备的浏览器资源,所选文件不会发送到 OmniKit。

OMNIKIT

面向图片和扫描 PDF 的私密 OCR

粘贴截图或添加 PNG、JPG、WebP、BMP 与 PDF。OmniKit 会优先读取 PDF 中已有的可选文字,仅在需要时运行 OCR。

OCR 引擎和语言数据都在浏览器本地运行。查看置信度、编辑识别结果,再复制文字或下载 TXT。