截图里的一段说明、拍下来的合同条款、扫描件上的一段正文,想把它们变成可以编辑、搜索、复制的文字,就需要 OCR。本工具把识别能力放进网页,上传图片即可得到可编辑文本,识别过程在浏览器本地完成,图片不会上传服务器。
可选自动识别、中文、英文与中英文四种语言设置。如果确定图片只有中文或只有英文,选择对应单项通常比中英文混合识别更准也更快;不确定时用自动识别,工具会根据情况选择中英文组合模型。首次使用某种语言时需要下载识别语言数据,之后浏览器会缓存,再次识别无需重复下载。
识别模式分四档:自动适用于大多数情况;文档文章适合排版规整的正文;截图网页适合屏幕截图与网页长图;单行文字适合只有一行内容的图片(例如验证码、标题条)。截图或网页版面出现串行、漏字时,切换模式往往能明显改善结果。页面在识别前会自动完成缩放、倾斜校正与图像增强,因此手机翻拍、轻微倾斜的图片也能得到较好的结果。
识别完成后可以点「重新识别」,工具会依次换用不同的增强策略(如自动增强、高对比度、二值化、白底黑字优化、锐化、原图不做增强)再次识别,不需要重新上传图片,适合在原图质量一般时多试几次挑最好的结果。如果仍然识别不到文字,页面会明确提示未识别到文字,建议换用更清晰、文字更大的图片。为减少误判,低置信度的行以及字符极少且置信度低的碎片会被过滤,避免对无文字图片输出无意义的乱码。
识别结果会显示在文本框中并可以直接修改:识别错的字改掉、多余的分行删掉、按需要重新分段都可以。下方同时给出字符数、行数与平均置信度,便于快速判断结果是否可靠。点「复制文字」把当前内容复制到剪贴板,点「下载 TXT」导出为文本文件——注意下载的是你当前编辑后的内容,而不是识别的原始结果,所以可以先把格式整理好再导出。另有「清空结果」可一键重置文本框。
当前浏览器不支持运行 OCR 时(需要较新的 Chrome、Edge、Firefox 或 Safari),会给出浏览器提示;识别引擎或语言数据加载失败时,会提示检查网络后重试;识别正在进行时再次点击会被拦截并提示稍候;未上传图片就点击识别会提示先上传图片;识别过程中可以取消。
适合提取截图中的说明文字、整理扫描合同与票据、把纸质资料转成可搜索文本、从图片报告中复制数据等场景。识别引擎与语言数据在浏览器本地运行,图片不会上传服务器,也不会被保存。
评论 0