प्रतिमा / PDF मजकूर एक्स्ट्रक्टर

तुमच्या ब्राउझरमधील स्क्रीनशॉट, फोटो आणि PDF मधून मजकूर काढा आणि पुनरावलोकन करा.

प्रतिमा किंवा एक PDF निवडा, मजकूर भाषा निवडा आणि काढा. मूळच्या बाजूला प्रत्येक पृष्ठाचे पुनरावलोकन करा, कोणत्याही चुका संपादित करा, नंतर TXT कॉपी किंवा डाउनलोड करा.

कसे वापरावे

स्क्रीनशॉट किंवा PDF मधून मजकूर काढा

प्रतिमा किंवा एक PDF निवडा, मजकूर भाषा निवडा आणि काढा. मूळच्या बाजूला प्रत्येक पृष्ठाचे पुनरावलोकन करा, कोणत्याही चुका संपादित करा, नंतर TXT कॉपी किंवा डाउनलोड करा.

उदाहरण आणि अपेक्षित परिणाम

उदाहरण: नमुना इनव्हॉइसमध्ये "एकूण: 125.50 USD" समाविष्ट आहे. कॉपी करण्यापूर्वी मूळ संख्या तपासा. TXT मजकूर आणि पृष्ठ विभाजक ठेवते; ते टेबल किंवा पीडीएफ लेआउट जतन करत नाही.

ओळख मर्यादा

10 प्रतिमा किंवा 20 पृष्ठांसह एक PDF. मुद्रित मजकूर उत्तम कार्य करतो. सारण्या, हस्तलेखन आणि जटिल स्तंभांना मॅन्युअल पुनरावलोकन आवश्यक आहे. बंगाली ओळख समर्थित नाही.

अरबी, उर्दू आणि व्हिएतनामी निकाल काळजीपूर्वक तपासा: मिश्र लिपी किंवा उच्चार गहाळ संख्या किंवा अक्षरे होऊ शकतात.

प्रथम डाउनलोड करा

आवश्यकतेनुसार इंजिन आणि निवडलेले मॉडेल डाउनलोड केले जातात. फाइल्स या ब्राउझरमध्ये राहतात. गुणवत्ता मोड सुमारे 31 MB मॉडेल आणि इंजिन लोड करते; लाइटवेट मोड सुमारे 6 MB मॉडेल लोड करतो. कॅश्ड मालमत्ता पुन्हा वापरल्या जाऊ शकतात.

PDF मजकूर स्तर

विद्यमान PDF मजकूर थेट काढला जातो. स्कॅन केलेली पृष्ठे OCR वापरतात. मूळ मजकूर स्तर अपूर्ण असल्यास हे पृष्ठ पुन्हा ओळखणे OCR ला सक्ती करते. निर्यात हा साधा मजकूर आहे, शोधण्यायोग्य PDF किंवा Excel सारणी नाही.