图片 / PDF 文字提取

在浏览器中提取截图、照片和 PDF 里的文字,边对照边修改。

选择图片或一份 PDF,选择文字语言并提取。对照原稿逐页检查、修改错字,再复制或下载 TXT。

使用说明

从截图或 PDF 提取文字

选择图片或一份 PDF,选择文字语言并提取。对照原稿逐页检查、修改错字,再复制或下载 TXT。

实际例子与结果

示例票据包含“Total: 125.50 USD”。复制前请对照原稿核对数字。TXT 保留文字与分页分隔,不保留表格或 PDF 排版。

认可限制

最多 10 张图像或一份 20 页的 PDF。印刷文本效果最好。表格、手写和复杂的列需要人工审核。不支持孟加拉语识别。

请仔细核对阿拉伯语、乌尔都语和越南语结果:混合文字或重音符号可能导致数字、字母缺失。

首次下载

需要时下载引擎和选定的模型。文件保留在此浏览器中。质量模式加载约 31 MB 的模型和引擎;轻量级模式加载约 6 MB 的模型。缓存的资源可以重复使用。

PDF文本图层

直接提取现有的 PDF 文本。扫描的页面使用 OCR。如果原始文本图层不完整,再次识别此页面会强制进行 OCR。导出为纯文本,而不是可搜索的 PDF 或 Excel 表格。