テキストクリーナー
余分なスペースを削除し、コピーされたテキストの改行を修正します。元のテキストは比較のために保持されます。
ブラウザーでスクリーンショット、写真、PDF からテキストを抽出して確認します。
画像または 1 つの PDF を選択し、テキスト言語を選択して抽出します。オリジナルの横にある各ページを確認し、間違いがあれば編集してから、TXT をコピーまたはダウンロードします。
コピーする前にテキストを確認してください。行を選択すると、オリジナル内でその行が検索されます。
画像または 1 つの PDF を選択し、テキスト言語を選択して抽出します。オリジナルの横にある各ページを確認し、間違いがあれば編集してから、TXT をコピーまたはダウンロードします。
例: サンプル請求書には「合計: 125.50 USD」が含まれています。コピーする前に、オリジナルと番号を比較してください。 TXT はテキストとページの区切り文字を保持します。テーブルや PDF レイアウトは保持されません。
最大 10 枚の画像、または 20 ページの 1 つの PDF。印刷されたテキストが最適です。表、手書き、複雑な列は手動で確認する必要があります。ベンガル語の認識はサポートされていません。
アラビア語、ウルドゥー語、ベトナム語の結果を注意深く確認してください。スクリプトやアクセントが混在していると、数字や文字が欠落する可能性があります。
必要に応じて、エンジンと選択したモデルがダウンロードされます。ファイルはこのブラウザ内に残ります。品質モードでは、約 31 MB のモデルとエンジンがロードされます。軽量モードでは、約 6 MB のモデルがロードされます。キャッシュされたアセットは再利用できます。
既存の PDF テキストが直接抽出されます。スキャンされたページは OCR を使用します。元のテキスト レイヤーが不完全な場合は、このページを再度認識して OCR を強制します。エクスポートはプレーン テキストであり、検索可能な PDF や Excel テーブルではありません。