图片/PDF 文字识别(OCR)
照片、扫描件、PDF 里的文字一键提取——支持 11 种语言,可复制可下载
🪙 …
每个文件 2 点 · 支持图片和最多 20 页的 PDF
服务器端 FFmpeg 支持任意格式——包括浏览器放不了的 HEVC/H.265。文件在 30 分钟内自动从服务器删除。
📄
服务器处理中…0%
⚠️ 处理完成前请不要关闭或刷新此页面,否则可能无法获取处理结果。
💡 大文件按你自己网络的速率传输:上传会自动继续、可安全断点续传,网速慢只影响时间,绝不会影响你的积分。
识别流程的工作原理
两种模式共用同一套服务器端 OCR 引擎,但各自做了不同的预设调优:
- 照片模式——识别前先对倾斜页面纠偏并归一化曝光;最适合文档、标牌,以及想尝试手写体识别的场景。
- 截图模式——为界面文字保留字符间距:聊天气泡、菜单、终端输出和像素字体都能完好识别,而这些恰恰是通用 OCR 最容易糊掉的。
- 语言——基于 Tesseract 支持 100+ 种语言并自动检测文字体系;中英混排截图可逐行分别识别。
- 输出——保留阅读顺序的纯文本;低置信度词语附带置信标记,方便你重点校对。
两套 OCR 引擎,一个工作区
照片模式针对相机实拍做透视校正识别;截图模式专为聊天界面、代码和游戏文字调优——按任务随手切换,无需离开页面。
📖
双模式识别
通用图片 OCR 与专注截图的 OCR 功能集成于同一工具。
📸
多语言支持
引擎支持全部十一种网站语言的文字识别。
🌍
识别 11 种语言
图片在服务器完成识别后即被自动删除。
✅
置信度标记
低置信度的词语会被逐一标记出来,让你清楚知道该校对哪些位置,而不是盲目相信输出结果。
如何使用
- 1
选择「图片」或「截图」识别模式。
- 2
上传包含文字的图片。
- 3
复制或下载识别出的文字。
- 4
在页面上直接复制识别出的文字,或下载为 UTF-8 编码的 TXT 文件。
常见问题
能识别 PDF 吗?⌄
可以,两种模式均支持 PDF 页面作为输入。
支持手写体识别吗?⌄
对印刷体文字识别效果最佳;手写体识别效果不作保证。
我的图片会被保留吗?⌄
不会。文字提取完成后,图片即从服务器自动删除。
为什么手写体常常识别失败?⌄
这款引擎针对的是印刷体。一笔一画写得工整的字母有时能认出来;连笔手写体则需要专门的手写识别模型——这款工具不会假装自己具备这一能力。
相关工具
什么是图片 OCR?
图片 OCR 将文字图片转化为可编辑、可选中的文本。适用于扫描文档、书页照片以及应用程序或聊天窗口的截图。
支持的功能
- 从照片与扫描件中提取文字
- 识别截图与聊天窗口中的文字
- 同一引擎支持多语言识别
适用场景
- 将纸质笔记或收据数字化
- 复制无法直接选中的图片文字
- 将截图转化为可编辑内容
图片上传至服务器进行识别后即被自动删除。