清理文本空格
去掉多余空格,整理复制文字的换行,保留原文以便比较。
文本本地处理
在浏览器中提取截图、照片和 PDF 里的文字,边对照边修改。
选择图片或一份 PDF,选择文字语言并提取。对照原稿逐页检查、修改错字,再复制或下载 TXT。
复制前检查文本。选择一行以在原文中找到它。
选择图片或一份 PDF,选择文字语言并提取。对照原稿逐页检查、修改错字,再复制或下载 TXT。
示例票据包含“Total: 125.50 USD”。复制前请对照原稿核对数字。TXT 保留文字与分页分隔,不保留表格或 PDF 排版。
最多 10 张图像或一份 20 页的 PDF。印刷文本效果最好。表格、手写和复杂的列需要人工审核。不支持孟加拉语识别。
请仔细核对阿拉伯语、乌尔都语和越南语结果:混合文字或重音符号可能导致数字、字母缺失。
需要时下载引擎和选定的模型。文件保留在此浏览器中。质量模式加载约 31 MB 的模型和引擎;轻量级模式加载约 6 MB 的模型。缓存的资源可以重复使用。
直接提取现有的 PDF 文本。扫描的页面使用 OCR。如果原始文本图层不完整,再次识别此页面会强制进行 OCR。导出为纯文本,而不是可搜索的 PDF 或 Excel 表格。