什么是 OCR - Image Reader?
OCR - Image Reader 是一款浏览器扩展,为您的浏览器添加一个工具栏按钮。点击后,您可以选择屏幕上的一个区域,扩展会捕获该区域,并使用内置的OCR引擎识别和提取图像中的文本。它支持超过100种语言,并能处理各种内容类型,包括图像、PDF和PowerPoint幻灯片。
如何使用 OCR - Image Reader?
- 从Chrome网上应用店安装该扩展。点击工具栏按钮,然后选择屏幕上的一个区域。扩展会捕获该区域并执行OCR,显示提取的文本。首次运行时,可能需要几分钟来获取语言训练数据,但后续使用会很快。如果提取不准确,您还可以修改图像并将其拖放到界面中重试。
OCR - Image Reader 的核心功能
- 捕获任意屏幕区域并使用OCR提取文本
- 支持超过100种语言,自动检测文本方向和脚本
- 两种引擎:Tesseract用于纯文本,IBM Granite-Docling用于格式化(标题、列表、样式、表格、公式)
- 离线处理,无服务器端交互
- 每个检测模块都有进度条
- 低置信度提取时自动反转图像重试(适用于深色主题)
- 可修改并重新拖放图像以重试
- 无长期资源占用;JS库按需加载
用户评价
5.0
/ 50 条评价
5 星
0
4 星
0
3 星
0
2 星
0
1 星
0
暂无评价,来写第一条吧
相似产品
OCR - Image Reader 推广组件
使用网站徽章展示您的产品已收录于 Hootool,帮助更多人按问题找到合适的 AI 工具。推广组件可轻松添加到主页或页脚。







