图片转文字:免费在线 OCR
用支持 12 种语言的 OCR 从图片和截图中提取文字,然后复制或下载为纯文本、JSON 或 Markdown。在浏览器中运行。
正在加载图片转文字(OCR)…
您的文件绝不离开您的设备
如何使用图片转文字(OCR)
- 1
在此页面打开图片转文字(OCR),它直接在浏览器中加载。
- 2
添加文件、文本或数值,并调整设置。
- 3
复制或下载结果。不会上传或存储任何内容。
如何从图片中提取文字
光学字符识别(OCR)把你在图片中看到的文字变成可以选择、复制、搜索和编辑的文本。不必再手动输入扫描的信件、拍下的白板、错误信息截图或书页上的引文,交给电脑来读即可。
本转换器使用完全在浏览器中运行的 Tesseract OCR 引擎,可识别 12 种语言:英语、西班牙语、法语、德语、意大利语、葡萄牙语、俄语、阿拉伯语、简体中文、日语、韩语和印地语。干净的截图选择 Fast 模式;照片和较难识别的图片选择 Accurate 模式,它会进行额外的预处理。结果会显示提取的文字、置信度以及字符、行和段落数,可复制或下载为纯文本、JSON 或 Markdown。
如何使用图片转文字(OCR)
- 上传图片、截图或文件照片。清晰、光线充足、对比度好的图片效果最好。
- 选择文字的 Language,并选择 Fast 或 Accurate 模式。
- 开始识别并观察进度条;首次使用某种语言时需要加载数据,耗时会稍长。
- 检查提取的文字,可选择去除换行或转换大小写,然后复制或下载为 TXT、JSON 或 Markdown。
OCR 可以做什么
- 纸质文件数字化,例如信件、发票和打印表格。
- 从截图中复制文字,包括错误对话框和无法选中文字的图片。
- 笔记和白板,在会议或课堂上拍下的内容。
- 外语文字,想粘贴到翻译工具中。
Fast 与 Accurate 模式
Fast 模式把图片原样交给 OCR 引擎,适合干净的截图和数字文本。Accurate 模式会先把图片转为高对比度灰度,有助于识别纸张照片、光线不均和字迹较淡的印刷品,代价是稍慢一些。如果某种模式效果不好,在重新拍照之前先试试另一种。
输出格式
纯文本保留识别出的原始行。格式化选项把空行整理成干净的段落,Markdown 会分隔段落,便于粘贴到笔记和文档中,JSON 则返回文字以及语言和置信度,方便在脚本中使用。
OCR 的准确度取决于图片。常见字体的印刷文字通常几乎完美识别;手写、装饰字体、很小的文字或歪斜的照片错误会更多,因此重要结果请务必校对。二维码请改用二维码扫描器。对于多页文件,可以逐页拍照并分别识别,再把结果拼接起来。
私密、免费、快速
识别在你的浏览器中通过开源 Tesseract OCR 引擎完成。首次使用某种语言时,其识别数据会从公共 CDN 下载一次;你的图片本身从不上传,始终留在你的设备上。无需注册,没有限制。
功能
- 支持 12 种语言的 OCR
- Fast 和 Accurate 两种模式
- 置信度和文本统计
- 复制或下载 TXT、JSON 或 Markdown
- 去除换行和转换大小写
- 图片不会离开你的设备
常见问题
这个 OCR 工具免费吗?
是的,完全免费,无需注册,也没有页数限制。
支持哪些语言?
英语、西班牙语、法语、德语、意大利语、葡萄牙语、俄语、阿拉伯语、简体中文、日语、韩语和印地语。
能识别手写吗?
只能有限识别。Tesseract 针对印刷文字设计;工整的分开书写的字母可能可以,连笔手写通常不行。
如何提高准确度?
使用清晰、端正、光线充足、对比度好的图片,选择正确的语言,照片可尝试 Accurate 模式。
我的图片会被上传吗?
不会。识别在浏览器中完成;只有首次使用时会从 CDN 下载语言数据。
我的文件会上传到服务器吗?
不会。所有处理都在浏览器本地完成,不会向服务器发送任何内容。关闭标签页后数据即被清除。
