图片转文字(免费在线 OCR)
xFormat.space 在浏览器本地运行文字识别模型,识别图片中的文字,支持中英文、日语、韩语、法语和德语,图片不会上传。
在浏览器本地运行——文件不会离开你的设备。
使用步骤
把截图、拍下来的书页或扫描的小票变成可以复制、编辑的文字。识别模型跑在你的设备上,图片本身不会上传。首次使用需要下载约 15 MB 的模型,之后会缓存,下次不用再下。
- 1
把图片(JPG、PNG 或 WebP)拖进页面,打开 OCR 功能。
- 2
选择与文字对应的识别语言。
- 3
点击“开始识别”,然后可以编辑、复制文字,或下载为 TXT 文件。
语言怎么选
共有六个选项,每次选其一:中英文、英语、日语、韩语、法语、德语。“中英文”选项可同时识别中文(简体和繁体)与英文,中英混排的内容用它。纯英文文档选“英语”更合适。第一次切换到某种语言时,会加载对应的模型。
怎样让识别更准
识别准确率很大程度取决于输入图片。尽量用原始截图,而不是经过聊天软件压缩转发的版本。拍纸质文档时,正对着拍,光线均匀,文字尽量占满画面,别让阴影压在文字行上;先把杂乱的背景裁掉,避免强烈反光。印刷体效果最好,手写体和艺术字体则不太稳定。
识别完成后会显示找到的文字区域数量和平均置信度。把它当作参考而不是保证,数字、人名和涉及法律、财务的内容务必人工校对。结果文本框可以直接编辑,复制之前先改正错误。首次下载模型需要联网,但你的图片依然只留在本机。
常见问题
怎么提取图片里的文字?
把图片拖进页面,选择语言,点“开始识别”,识别出的文字会出现在可编辑的文本框里,可以复制或下载为 TXT。
OCR 支持哪些语言?
中英文(同时也能识别繁体中文)、英语、日语、韩语、法语和德语,每次识别选择其中一种。
OCR 时图片会被上传到服务器吗?
不会。识别模型在你的浏览器里运行,只有模型文件需要下载(首次约 15 MB),图片始终留在本机。
为什么第一次识别比较慢?
第一次需要下载文字识别模型和相关组件,之后会缓存,再次使用启动会快很多。
能识别手写字吗?
它主要面向印刷体。工整的手写体可能能识别一部分,但结果不稳定,请务必核对输出。