不必先保存文件,复制截图后在页面任意位置粘贴即可。
图片留在本地,文字带得走
看得见的文字,
现在可以复制。
粘贴截图,或上传图片与扫描版 PDF。识别中文、英文和数字,整理后直接复制或下载。
LOCAL OCR
图片 / PDF 文字识别
文件不会上传
INPUT PAGES
待处理页面
尚未添加文件
+等待图片或 PDF
你可以连续添加多个文件。
自动渲染每一页,也会优先读取 PDF 已有的可选文字。
OCR 引擎和语言模型都在浏览器运行,文件不会发送到服务器。
先判断是否需要 OCR,再决定是否压缩
先在原 PDF 中尝试选择文字,已有可搜索文字时应保留原件。扫描件可用练习页面检查编号、金额 123.45 和 O/0 等相似字符;OCR 结果需要对照原图逐项核对。
查看案例、样本与具体规则 →先把原稿处理清楚,再决定能否信任识别结果
OCR 是把可见字形转换为可编辑文字,并不保证完全准确。端正、清晰、语言选择正确和人工复核,比简单重复识别更重要。
使用步骤
- 使用最清晰的来源
尽量使用原始扫描件或照片,裁掉无关边框,校正倾斜,避免阴影,并确认小字没有因对焦或压缩而模糊。
- 选择对应语言
识别语言应与页面一致。中英文混排会增加处理时间,也更容易混淆相似字母、汉字、数字和标点。
- 逐页人工复核
重点对照姓名、日期、金额、小数点、账号、表格和换行,不要一次性接受未经检查的大段输出。
- 把结果当作工作副本
下载纯文字后继续编辑,并保留原图片或 PDF。涉及法律、医疗、学术或财务信息时,OCR 结果只能作为草稿。
选择参考
- 清晰扫描件
- 文字水平、对比度高且字号足够时,通常最容易得到稳定结果。
- 手机拍照
- 光线均匀、相机与纸面平行、没有手指遮挡和书页弯曲时效果更好。
- 扫描 PDF
- 需要逐页渲染后再识别,长文档会消耗更多时间和设备内存。
- 手写与表格
- 难度高于普通印刷段落,经常需要人工校正或更专业的识别流程。
重要限制
- OCR 可能混淆 O 与 0、l 与 1 以及外形相似的标点和汉字。
- 复杂表格、多栏排版、印章、手写内容和低对比背景可能丢失阅读顺序。
- 识别质量受原稿限制,放大模糊图片无法恢复没有拍到的真实细节。
- 使用或分享重要数值前,必须回到原文逐项核对。
04 · 常见问题
常见问题
为什么姓名和数字更容易识别错?
识别依赖字形和上下文;专有名词、代码和孤立数字的上下文较少,因此更需要人工检查。
很模糊的照片还能恢复文字吗?
可能识别出部分内容,但锐化和放大不能补回原本没有记录的细节,重新扫描或拍照更可靠。
文档会上传吗?
不会。识别使用当前设备的浏览器资源,所选文件不会发送到 OmniKit。
面向图片和扫描 PDF 的私密 OCR
粘贴截图或添加 PNG、JPG、WebP、BMP 与 PDF。OmniKit 会优先读取 PDF 中已有的可选文字,仅在需要时运行 OCR。
OCR 引擎和语言数据都在浏览器本地运行。查看置信度、编辑识别结果,再复制文字或下载 TXT。