मुफ़्त लोकल OCR · 21 भाषाएँ · मिली-जुली भाषाएँ · बिना अपलोड

Image to Markdown कन्वर्टर (OCR)

यह image to markdown converter छपे हुए टेक्स्ट वाली फ़ोटो या स्क्रीनशॉट को Markdown में बदलता है — तस्वीर को कहीं भेजे बिना। OCR इंजन आपके ब्राउज़र के अंदर चलता है, 21 भाषाओं को सपोर्ट करता है और मिली-जुली भाषाओं वाले पन्ने भी पढ़ता है: आप टेक्स्ट की मुख्य भाषा चुनते हैं, ज़रूरत हो तो दूसरी, और जिन लिपियों के पैक अपने आप अंग्रेज़ी नहीं पढ़ पाते उनके साथ अंग्रेज़ी पैक खुद लोड हो जाता है। तस्वीर आपके डिवाइस पर ही रहती है, और इंजन तथा भाषा पैक एक बार डाउनलोड हो जाएँ तो कन्वर्टर ऑफ़लाइन भी चलता है।

Image → Markdown

छपे हुए टेक्स्ट वाली एक तस्वीर चुनें

सिर्फ़ आपके ब्राउज़र में
तस्वीर

ब्राउज़र जिसे पढ़ सके ऐसी फ़ोटो या स्क्रीनशॉट चुनें, यहाँ छोड़ें, या Ctrl+V / ⌘V से पेस्ट करें। LensUp उसे अपलोड नहीं करता।

टेक्स्ट की भाषा
इस पन्ने की भाषा के आधार पर पहले से चुना गया है। पन्ने पर छपी भाषा चुनें।

सिर्फ़ छपा हुआ टेक्स्ट। एक पन्ने पर दो भाषाएँ हो सकती हैं: मुख्य भाषा चुनें, दूसरी जोड़ें, और जो पैक अकेले अंग्रेज़ी नहीं पढ़ पाते उनके साथ अंग्रेज़ी पैक भी जुड़ जाता है। लाइनों वाली तालिकाएँ Markdown तालिकाएँ बनती हैं; हस्तलेख, बिना लाइन वाली तालिकाएँ, सूत्र और कॉलम अनुमानित हैं — भरोसा करने से पहले जाँचें।

Image to Markdown कन्वर्टर से तस्वीर को Markdown में कैसे बदलें?

Image to Markdown कन्वर्टर खोलें, छपे हुए टेक्स्ट वाली कोई फ़ोटो या स्क्रीनशॉट चुनें, टेक्स्ट की भाषा जाँचें और “टेक्स्ट पहचानें” दबाएँ। LensUp OCR आपके अपने डिवाइस पर चलाता है — पन्ने पर दो भाषाएँ हों तो दूसरी भाषा के साथ, और जिन भाषाओं के पैक अकेले अंग्रेज़ी नहीं पढ़ पाते, उनके साथ अंग्रेज़ी पैक भी जोड़कर — पैराग्राफ़, बुलेट और नंबर वाली सूचियों को Markdown ब्लॉक बना देता है, और नतीजा आप सुधार सकते हैं, कॉपी कर सकते हैं या .md के रूप में डाउनलोड कर सकते हैं। तस्वीर कभी अपलोड नहीं होती।

यह उस टेक्स्ट के लिए है जिसे आप तस्वीर नहीं, नोट के रूप में रखना चाहते हैं: किताब या नोट्स का कोई पन्ना, प्रोजेक्टर पर कोई स्लाइड, साफ़ बड़े अक्षरों में लिखा व्हाइटबोर्ड का सार, छपी हुई रेसिपी, किसी प्रोडक्ट का लेबल, कोई फ़ॉर्म या पोस्टर का कोई पैराग्राफ़। पहचाना गया टेक्स्ट संपादन-योग्य Markdown के रूप में मिलता है — Obsidian, Notion, GitHub issue या किसी भी प्लेन-टेक्स्ट नोटबुक के लिए तैयार।

इसका दायरा जान-बूझकर सीमित रखा गया है। यह सिर्फ़ छपा हुआ टेक्स्ट पढ़ता है, आपकी चुनी भाषा और वैकल्पिक दूसरी भाषा में; जो ढाँचा दिखता है — पैराग्राफ़, बुलेट सूची, नंबर वाली सूची, बड़े शीर्षक और लाइनों वाली तालिकाएँ — उसे Markdown में रखता है, और कॉलम, हस्तलेख और गणितीय सूत्रों को अनुमानित टेक्स्ट की तरह छोड़ देता है जिसे आपको पंक्ति-दर-पंक्ति जाँचना चाहिए। Image to Markdown, image to MD, photo to Markdown, screenshot to Markdown, JPG to Markdown, फ़ोटो से OCR टेक्स्ट: नाम अलग-अलग, काम एक ही, और नतीजा हमेशा Markdown होता है, जिसे आप भरोसा करने से पहले जाँचते हैं।

Image to Markdown: तस्वीर को Markdown में बदलने के चरण

  1. एक तस्वीर चुनेंछपे हुए टेक्स्ट वाली फ़ोटो या स्क्रीनशॉट चुनें, टूल पर खींचकर छोड़ें या Ctrl+V / ⌘V से क्लिपबोर्ड से पेस्ट करें। JPG, PNG, WebP, iPhone का HEIC और TIFF सब आपके डिवाइस पर ही पढ़े जाते हैं; पन्ना तस्वीर और उसका आकार दिखाता है, कुछ अपलोड नहीं करता।
  2. भाषा जाँचें और पहचानेंछपे हुए टेक्स्ट की भाषा चुनें (मेन्यू इस पन्ने की भाषा पहले से चुन लेता है), पन्ने पर दो भाषाएँ हों तो दूसरी भाषा जोड़ें, और “टेक्स्ट पहचानें” दबाएँ। पहली बार OCR इंजन (लगभग 1.5 MB) और ज़रूरी भाषा पैक (हर एक 0.4–3 MB) डाउनलोड होते हैं, फिर कैश में रहते हैं। पहचान आपके डिवाइस पर होती है और प्रोग्रेस बार उसकी प्रगति दिखाता है।
  3. जाँचें, कॉपी करें या डाउनलोड करेंMarkdown फ़ोटो के बगल में संपादन-योग्य बॉक्स में आता है, शब्दों या अक्षरों की गिनती और औसत कॉन्फ़िडेंस के साथ। इंजन ने जो गलत पढ़ा हो उसे सुधारें, फिर क्लिपबोर्ड पर कॉपी करें या .md फ़ाइल डाउनलोड करें।

क्या Markdown बनता है, और क्या नहीं

हर छपा हुआ पैराग्राफ़ एक Markdown पैराग्राफ़ बनता है: पंक्तियाँ आपस में जोड़ दी जाती हैं और पंक्ति के अंत में हाइफ़न से टूटे शब्द फिर से जुड़ जाते हैं; चीनी, जापानी और थाई पंक्तियाँ बिना स्पेस के जुड़ती हैं और शब्दों की बजाय अक्षरों में गिनी जाती हैं। बुलेट चिह्न से शुरू होने वाली पंक्तियाँ सूची बनती हैं; 1., 2., 3. से — या पूर्वी एशियाई पाठ में 一、二、三 और 1、2、3 से — शुरू होने वाली पंक्तियाँ नंबर वाली सूची बनती हैं; और अकेली छोटी पंक्ति जो मुख्य टेक्स्ट से साफ़ बड़े आकार में छपी हो या पूरी तरह बड़े अक्षरों में हो, दूसरे स्तर का शीर्षक बनती है। बाकी सब पढ़ने के क्रम में सादा टेक्स्ट रहता है।

लाइनों से बनी तालिका Markdown तालिका बनती है: पहचान से पहले ग्रिड मिटा दिया जाता है, हर छपी पंक्ति तालिका की पंक्ति बनती है और पंक्तियों के साझा खाली हिस्से कॉलम बनते हैं; इसलिए जुड़ी हुई कोशिकाएँ और बिना लाइन वाली तालिकाएँ टेक्स्ट की पंक्तियों के रूप में निकलती हैं। गणितीय सूत्र नहीं पहचाने जाते — भिन्न, घात और चिह्न बिखर जाते हैं; दो-कॉलम वाले लेआउट आपस में गुँथ सकते हैं; हस्तलेख, सजावटी फ़ॉन्ट, बहुत छोटे अक्षर और जटिल बैकग्राउंड पर लिखा टेक्स्ट खराब पढ़ा जाता है या छूट जाता है। अंक, नाम और कोड दोबारा देखने लायक हैं: वहाँ एक गलत अक्षर पैराग्राफ़ की गलती से ज़्यादा भारी पड़ता है। नतीजे के नीचे दिखा औसत कॉन्फ़िडेंस इंजन का अपना अनुमान है, कोई वादा नहीं।

फ़ोन की फ़ोटो से साफ़ नतीजा कैसे पाएँ

अक्षर-पहचान समतल पन्ने पर साफ़, समान रोशनी वाले टेक्स्ट पर सबसे अच्छा काम करती है, जिसकी फ़ोटो सीधे सामने से ली गई हो — लगभग 300 dpi स्कैन जितनी स्पष्टता के साथ। फ़्रेम को टेक्स्ट से भरें, छाया और चमक से बचें, और फ़ोकस लगने तक फ़ोन स्थिर रखें। बहुत बड़ी फ़ोटो पहचान से पहले लंबी भुजा पर 2600 px तक छोटी की जाती हैं; किताब और दस्तावेज़ का सामान्य टेक्स्ट पूरी तरह पढ़ने लायक रहता है और मेमोरी व समय बचता है।

पन्ना तिरछा या छायादार हो तो पहले उसे LensUp स्कैनर से गुज़ारें: परिप्रेक्ष्य सुधार और छाया हटाने से समतल, तेज़ कंट्रास्ट वाला पन्ना मिलता है, और स्कैनर से डाउनलोड की गई JPG या PNG यहाँ अच्छा इनपुट है। स्क्रीनशॉट भी सीधे पढ़े जाते हैं — आमतौर पर सबसे आसान मामला।

जब लोकल इंजन काफ़ी न हो: Pro से सुधारें

मुफ़्त विकल्प के पीछे का ओपन-सोर्स इंजन Tesseract गणितीय सूत्र नहीं पढ़ता और बिना लाइन वाली या जुड़ी कोशिकाओं वाली तालिकाओं में अटकता है। ऐसे पन्नों के लिए नतीजे का बॉक्स “Pro से सुधारें” दिखा सकता है — एक सशुल्क विकल्प जो साइट पर भुगतान चालू होने पर आता है: पूरी फ़ोटो एक बार, LensUp के सर्वर से होकर, Mathpix को भेजी जाती है — सूत्रों और तालिकाओं के लिए बनी एक व्यावसायिक OCR सेवा — और उसका Markdown लोकल नतीजे की जगह ले लेता है, सूत्र डॉलर चिह्नों के बीच LaTeX के रूप में और तालिकाएँ Markdown तालिकाओं के रूप में आती हैं। LensUp रास्ते में कुछ सहेजता नहीं (Mathpix फ़ोटो को अपनी शर्तों के अनुसार प्रोसेस करता है); लोकल नतीजा एक क्लिक में वापस लाया जा सकता है।

Pro का भुगतान हर बार के हिसाब से इसलिए है ताकि मुफ़्त विकल्प मुफ़्त और लोकल बना रहे: जब तक यह उपलब्ध है, ईमेल लिंक से साइन इन करें (कोई पासवर्ड नहीं), 50 रन के लिए $4.99 का एक बार का भुगतान करें (कोई सब्सक्रिप्शन नहीं), और हर Pro सुधार में एक रन लगता है। अगर सेवा-प्रदाता की ओर से रन विफल हो, तो कोई रन नहीं कटता।

मिली-जुली भाषाओं की पहचान आपके डिवाइस पर

इस टूल में 21 भाषाएँ उपलब्ध हैं: अंग्रेज़ी, फ़्रेंच, जर्मन, स्पेनिश, पुर्तगाली, इतालवी, पोलिश, तुर्की, इंडोनेशियाई, वियतनामी, चीनी (सरलीकृत और पारंपरिक), जापानी, कोरियाई, रूसी, अरबी, फ़ारसी, उर्दू, हिन्दी, बांग्ला और थाई — वही भाषाएँ जो LensUp खुद बोलता है। हर भाषा अलग पैक है जो तभी डाउनलोड होता है जब आप उसे चुनें: फ़्रेंच पन्ने के लिए 0.7 MB का पैक, चीनी के लिए लगभग 1.7 MB, कभी पूरा सेट नहीं। जो भाषा सचमुच छपी है वही चुनें और पन्ने पर दो भाषाएँ हों तो दूसरी जोड़ें; कोरियाई, रूसी, अरबी, फ़ारसी, उर्दू, हिन्दी, बांग्ला और थाई के साथ अंग्रेज़ी अपने आप लोड होती है, क्योंकि ये पैक अकेले अंग्रेज़ी शब्दों को मिलते-जुलते अक्षरों में बदल देते हैं। गलत पैक से Markdown की जगह टुकड़े निकलते हैं, स्टेटस लाइन यह बता देती है, और “भाषा पहचानें” हर लिपि के लिए एक पैक आज़माकर सही पैक ढूँढ लेता है — इसलिए मिली-जुली भाषाओं वाला पन्ना भी साफ़ Markdown बन जाता है।

सब कुछ ओपन-सोर्स इंजन से लोकल चलता है, जैसे LensUp बाकी तस्वीरें प्रोसेस करता है: न अपलोड, न खाता, न किसी सर्वर पर आपकी फ़ोटो या उसके टेक्स्ट की कॉपी। इंजन की फ़ाइलें और पैक lensup.ai से आते हैं और ब्राउज़र उन्हें कैश कर लेता है, इसलिए उसी भाषा में अगली बार पहचान तुरंत शुरू होती है। स्कैनर टूल्स में अब भी OCR नहीं है और वे टेक्स्ट-सर्च वाले PDF नहीं बनाते।

अक्सर पूछे जाने वाले सवाल

Image to Markdown कन्वर्टर से तस्वीर को Markdown में बदलते समय क्या वह मेरे डिवाइस से बाहर जाती है?

मुफ़्त विकल्प में नहीं: OCR इंजन और आपका चुना हुआ भाषा पैक आपके ब्राउज़र में डाउनलोड होते हैं और पहचान वहीं होती है, इसलिए फ़ोटो, पहचाना गया टेक्स्ट और .md फ़ाइल — कुछ भी LensUp के सर्वर तक नहीं पहुँचता। सिर्फ़ एक स्पष्ट अपवाद है, और वह भी पूरी तरह आपकी पसंद से: जब नतीजे का बॉक्स “Pro से सुधारें” दिखाए (भुगतान चालू होने पर आने वाला सशुल्क विकल्प), तो उस क्लिक से पूरी फ़ोटो LensUp से होकर Mathpix (सूत्रों और तालिकाओं की एक व्यावसायिक OCR सेवा) को जाती है और उसका Markdown वापस आता है; LensUp रास्ते में कुछ सहेजता नहीं (Mathpix फ़ोटो को अपनी शर्तों के अनुसार प्रोसेस करता है), ईमेल साइन-इन और सशुल्क क्रेडिट चाहिए (50 रन $4.99 में, एक बार), और लोकल नतीजा वापस लाया जा सकता है।

यह image to markdown converter कौन-सी भाषाएँ पढ़ता है?

छपे टेक्स्ट की इक्कीस भाषाएँ: अंग्रेज़ी, फ़्रेंच, जर्मन, स्पेनिश, पुर्तगाली, इतालवी, पोलिश, तुर्की, इंडोनेशियाई, वियतनामी, चीनी (सरलीकृत और पारंपरिक), जापानी, कोरियाई, रूसी, अरबी, फ़ारसी, उर्दू, हिन्दी, बांग्ला और थाई। एक पन्ने पर इनमें से दो हो सकती हैं: मुख्य भाषा चुनें, मिले-जुले पन्ने के लिए दूसरी जोड़ें, और कोरियाई, रूसी, अरबी, फ़ारसी, उर्दू, हिन्दी, बांग्ला और थाई के साथ अंग्रेज़ी अपने आप पढ़ी जाती है, क्योंकि ये पैक अकेले अंग्रेज़ी शब्दों को मिलते-जुलते अक्षरों में बदल देते हैं। हस्तलेख किसी भी भाषा में समर्थित नहीं है।

कुछ टेक्स्ट गलत या गायब क्यों है?

सबसे पहले भाषा पैक जाँचें: Markdown के नीचे की चेतावनी में “भाषा पहचानें” है, जो हर लिपि के लिए एक OCR पैक आज़माता है और सबसे अच्छा रखता है। उसके बाद फ़ोटो: धुँधलापन, चमक, छाया, तिरछापन, छोटे अक्षर, सजावटी फ़ॉन्ट और जटिल बैकग्राउंड — सब पहचान की गुणवत्ता घटाते हैं, और तालिकाएँ या कई कॉलम वाले पन्ने गलत क्रम में आ सकते हैं। पन्ना समतल रखकर साफ़ और स्पष्ट फ़ोटो दोबारा लें, या पहले स्कैनर में साफ़ करें, फिर इस्तेमाल से पहले Markdown जाँचें।