图片转文字:提取图片里的文字

在你的设备上运行 · 你的文件从不离开你的设备。

拍下来的通知、聊天截图、扫描的发票:文字识别会读出图片里的文字,直接复制,或者保存为Word、TXT文件。

识别简体中文、繁体中文和英文,中英混排也可以。识别模型在你的浏览器里运行——图片不上传,所以发票、身份证、病历都不会离开你的设备。

如何图片转文字:提取图片里的文字

  1. 添加照片、截图或扫描件。
  2. 选择语言:简体中文、繁体中文、英文或混排。
  3. 点击“提取文字”——第一次会下载一次模型,之后就缓存了。
  4. 复制文字,或下载为TXT或Word。

支持的格式与限制

输入
JPG、PNG、WebP、HEIC、扫描件PDF
输出
文字——复制、TXT或Word
语言
简体中文、繁体中文、英文、阿拉伯文等
运行位置
在浏览器本地完成,图片不上传

不适用于: 手写体和艺术字——清晰的印刷体识别可靠,其他情况效果较差。

常见问题

这是AI文字识别吗?
是——一个神经网络识别模型(Tesseract LSTM),在你的浏览器里运行。和云端识别服务不同,图片不会离开你的设备。
我的文件会上传到服务器吗?
不会。转换完全在你的浏览器里完成,用的是你自己设备的算力。文件不会离开你的电脑或手机——所以页面加载完成后,断网也照样能用。
识别准确率怎么样?
清晰的印刷体准确率很高。拍歪了、字太小、光线暗都会降低准确率——拍正、拍亮最有帮助。
为什么第一次识别比较慢?
第一次浏览器要下载中文识别模型(约2.5MB)并缓存。之后识别立刻开始,断网也能用。
手写体能识别吗?
不能可靠识别,只有印刷体才稳定。手写和艺术字会有缺漏。

文本与文档中的更多工具

图片 文件还能做什么

获得 文本 的其他方式

相关工具