tomai
登录
免费 · 格式转换

图片转文字(OCR)

从照片或截图里提取文字——免费,在浏览器里完成

内置 11 种语言。识别质量取决于图片的分辨率和清晰度。

🔒

100% 隐私 — 文件全部在你的浏览器本地转换,绝不上传到任何服务器。

如何使用

  1. 1

    拖入一张带文字的照片或截图。

  2. 2

    确认语言(内置 11 种语言,默认简体中文),点击提取。

  3. 3

    在页面上查看结果,复制文字,或下载为 .txt 文件。

永不外传截图的 OCR

📄

内置十一种 OCR 语言

英语、简体和繁体中文、日语、韩语、德语、西班牙语、法语、印地语、葡萄牙语和俄语,全部由 Tesseract LSTM 引擎驱动。语言选择器默认跟随页面语言,中文和日语与英语配对,适合中英混排页面。

小截图先做锐化处理

长边小于 1600 像素的图片在识别前会先放大 2 倍并转为灰度——9px 字号的原引擎完全识别不出的文字,预处理后约有 95% 可读。

🔒

支持五种图片格式

放入 PNG、JPG、WebP、BMP 或 GIF,即可得到纯文本 .txt 文件。页面边距产生的空白行会被清除,结果就是提取出的文字本身。

跑在 WebAssembly 里的 Tesseract

  • 完整 Tesseract 引擎以 WASM 在浏览器内运行——清晰扫描件的准确率与原生版相当。
  • 语言数据按脚本加载一次(eng、chi_sim、jpn…)并缓存复用。
  • 锐利、光照均匀、接近 300DPI 的输入远胜斜拍照片。

常见问题

我的图片会被上传吗?

不会——OCR 引擎完全在你的浏览器里用 WebAssembly 运行,图片绝不离开你的设备。

支持哪些语言?

支持全部 11 种站点语言:英文、中文(简体和繁体)、日文、韩文、德文、西班牙文、法文、印地文、葡萄牙文和俄文。☁️ 云端图片 OCR 工具还支持 PDF 和批量上传。

为什么识别结果是空的或很乱?

OCR 在清晰、对比度高、大小适中的文字上效果最好。字太小、模糊、倾斜或手写文字的识别率会明显下降。

文件大小有限制吗?

单张图片最多 20 MB。更大或细节更多的图片处理时间会稍长一些。

相关工具

什么是图片转文字(OCR)工具?

图片转文字工具,也就是 OCR(光学字符识别)工具,能从照片、截图或扫描件中读出文字,返回可编辑的纯文本。手工抄写图片里的文字又慢又容易出错——截图里的报错信息、打印的收据、扫描的页面、白板照片,文字都被困在像素里。这个工具在浏览器页面内运行真正的 OCR 引擎:放入 PNG、JPG、WebP、BMP 或 GIF 图片,识别出的文字就以 .txt 返回。它面向需要提取图片中文字的学生、研究人员和开发者。

核心功能

  • ✅ 支持 PNG、JPG、WebP、BMP 和 GIF 图片
  • ✅ 在浏览器内运行基于 Tesseract 的 OCR 引擎
  • ✅ 把识别出的文字保存为纯文本 .txt 文件
  • ✅ 无需上传、无需账号、没有使用次数限制
  • ✅ 识别过程中实时显示进度

什么时候会用到

  • 🖥️ 从截图中复制报错信息或代码片段
  • 🧾 把打印的收据、发票或名片数字化
  • 📄 从扫描页面提取文字,省去重新打字
  • 📋 把白板或幻灯片的照片变成可编辑的笔记

隐私内建:OCR 引擎完全在浏览器中运行,图片不会离开你的设备。内置全部 11 种站点语言:英文、中文(简体和繁体)、日文、韩文、德文、西班牙文、法文、印地文、葡萄牙文、俄文。需要识别 PDF 或批量任务时,云端图片 OCR 工具在服务器端运行同一套引擎。识别准确度取决于图片质量和字迹是否清晰,和所有 OCR 系统一样,手写体和重度艺术字识别效果较差。

相关工具