跳到正文
WoowTools

图片转文字:免费在线 OCR

用支持 12 种语言的 OCR 从图片和截图中提取文字,然后复制或下载为纯文本、JSON 或 Markdown。在浏览器中运行。

免费 在浏览器中运行 无需注册

正在加载图片转文字(OCR)…

您的文件绝不离开您的设备

如何使用图片转文字(OCR)

  1. 1

    在此页面打开图片转文字(OCR),它直接在浏览器中加载。

  2. 2

    添加文件、文本或数值,并调整设置。

  3. 3

    复制或下载结果。不会上传或存储任何内容。

如何从图片中提取文字

光学字符识别(OCR)把你在图片中看到的文字变成可以选择、复制、搜索和编辑的文本。不必再手动输入扫描的信件、拍下的白板、错误信息截图或书页上的引文,交给电脑来读即可。

本转换器使用完全在浏览器中运行的 Tesseract OCR 引擎,可识别 12 种语言:英语、西班牙语、法语、德语、意大利语、葡萄牙语、俄语、阿拉伯语、简体中文、日语、韩语和印地语。干净的截图选择 Fast 模式;照片和较难识别的图片选择 Accurate 模式,它会进行额外的预处理。结果会显示提取的文字、置信度以及字符、行和段落数,可复制或下载为纯文本、JSON 或 Markdown。

如何使用图片转文字(OCR)

  1. 上传图片、截图或文件照片。清晰、光线充足、对比度好的图片效果最好。
  2. 选择文字的 Language,并选择 Fast 或 Accurate 模式。
  3. 开始识别并观察进度条;首次使用某种语言时需要加载数据,耗时会稍长。
  4. 检查提取的文字,可选择去除换行或转换大小写,然后复制或下载为 TXT、JSON 或 Markdown。

OCR 可以做什么

  • 纸质文件数字化,例如信件、发票和打印表格。
  • 从截图中复制文字,包括错误对话框和无法选中文字的图片。
  • 笔记和白板,在会议或课堂上拍下的内容。
  • 外语文字,想粘贴到翻译工具中。

Fast 与 Accurate 模式

Fast 模式把图片原样交给 OCR 引擎,适合干净的截图和数字文本。Accurate 模式会先把图片转为高对比度灰度,有助于识别纸张照片、光线不均和字迹较淡的印刷品,代价是稍慢一些。如果某种模式效果不好,在重新拍照之前先试试另一种。

输出格式

纯文本保留识别出的原始行。格式化选项把空行整理成干净的段落,Markdown 会分隔段落,便于粘贴到笔记和文档中,JSON 则返回文字以及语言和置信度,方便在脚本中使用。

OCR 的准确度取决于图片。常见字体的印刷文字通常几乎完美识别;手写、装饰字体、很小的文字或歪斜的照片错误会更多,因此重要结果请务必校对。二维码请改用二维码扫描器。对于多页文件,可以逐页拍照并分别识别,再把结果拼接起来。

私密、免费、快速

识别在你的浏览器中通过开源 Tesseract OCR 引擎完成。首次使用某种语言时,其识别数据会从公共 CDN 下载一次;你的图片本身从不上传,始终留在你的设备上。无需注册,没有限制。

功能

  • 支持 12 种语言的 OCR
  • Fast 和 Accurate 两种模式
  • 置信度和文本统计
  • 复制或下载 TXT、JSON 或 Markdown
  • 去除换行和转换大小写
  • 图片不会离开你的设备

常见问题

这个 OCR 工具免费吗?

是的,完全免费,无需注册,也没有页数限制。

支持哪些语言?

英语、西班牙语、法语、德语、意大利语、葡萄牙语、俄语、阿拉伯语、简体中文、日语、韩语和印地语。

能识别手写吗?

只能有限识别。Tesseract 针对印刷文字设计;工整的分开书写的字母可能可以,连笔手写通常不行。

如何提高准确度?

使用清晰、端正、光线充足、对比度好的图片,选择正确的语言,照片可尝试 Accurate 模式。

我的图片会被上传吗?

不会。识别在浏览器中完成;只有首次使用时会从 CDN 下载语言数据。

我的文件会上传到服务器吗?

不会。所有处理都在浏览器本地完成,不会向服务器发送任何内容。关闭标签页后数据即被清除。