বিনামূল্যে লোকাল OCR · ২১ ভাষা · মিশ্র ভাষা · আপলোড ছাড়াই
Image to Markdown কনভার্টার (OCR)
এই image to markdown converter ছাপা লেখা আছে এমন ছবি বা স্ক্রিনশটকে Markdown-এ বদলে দেয় — ছবিটি কোথাও না পাঠিয়ে। OCR ইঞ্জিন আপনার ব্রাউজারের ভেতরেই চলে, ২১টি ভাষা সমর্থন করে, আর মিশ্র ভাষার পাতাও পড়ে: আপনি লেখার মূল ভাষা বেছে নেন, দরকারে দ্বিতীয়টি, আর যেসব লিপির প্যাক নিজে থেকে ইংরেজি পড়তে পারে না, তাদের সঙ্গে ইংরেজি প্যাক স্বয়ংক্রিয়ভাবে লোড হয়। ছবি আপনার ডিভাইসেই থাকে, আর ইঞ্জিন ও ভাষার প্যাক একবার ডাউনলোড হয়ে গেলে কনভার্টার অফলাইনেও চলে।
Image → Markdown
ছাপা লেখা আছে এমন একটি ছবি বেছে নিন
ব্রাউজার পড়তে পারে এমন ছবি বা স্ক্রিনশট বাছুন, এখানে ছাড়ুন, বা Ctrl+V / ⌘V দিয়ে পেস্ট করুন। LensUp এটি আপলোড করে না।
শুধু ছাপা লেখা। এক পাতায় দুটি ভাষা থাকতে পারে: মূল ভাষা বাছুন, দ্বিতীয়টি যোগ করুন, আর যেসব প্যাক একা ইংরেজি পড়তে পারে না, সেগুলোর সঙ্গে ইংরেজি প্যাকও লোড হয়। রেখাযুক্ত টেবিল Markdown টেবিল হয়; হাতের লেখা, দাগহীন টেবিল, সূত্র আর কলামের শনাক্তকরণ আনুমানিক — ভরসা করার আগে যাচাই করুন।
Pro এই পুরো ছবি একবার LensUp-এর সার্ভার হয়ে Mathpix-এ পাঠায় — সূত্র ও টেবিল পড়ার জন্য তৈরি একটি বাণিজ্যিক OCR সেবা — আর Markdown-এর জায়গায় তার ফলাফল বসায় (সূত্র $…$ হিসেবে)। LensUp ছবি সংরক্ষণ করে না; Mathpix নিজের শর্ত অনুযায়ী এটি প্রক্রিয়া করে। প্রতিটি Pro রান একটি ক্রেডিট ব্যবহার করে; ৫০টি রান ৪.৯৯ মার্কিন ডলারে, একবার, কোনো সাবস্ক্রিপশন নেই।
Image to Markdown কনভার্টার দিয়ে ছবিকে Markdown-এ বদলাব কীভাবে?
Image to Markdown কনভার্টারটি খুলুন, ছাপা লেখা আছে এমন একটি ছবি বা স্ক্রিনশট বেছে নিন, লেখার ভাষা মিলিয়ে দেখুন আর “লেখা শনাক্ত করুন” চাপুন। LensUp আপনার নিজের ডিভাইসেই OCR চালায় — পাতায় দুটি ভাষা থাকলে দ্বিতীয় ভাষাসহ, আর যেসব ভাষার প্যাক একা ইংরেজি পড়তে পারে না, সেগুলোর সঙ্গে ইংরেজি প্যাকও লোড করে — অনুচ্ছেদ, বুলেট আর সংখ্যাযুক্ত তালিকাকে Markdown ব্লকে বদলে দেয়; ফলাফল আপনি ঠিক করতে, কপি করতে বা .md হিসেবে ডাউনলোড করতে পারেন। ছবি কখনও আপলোড হয় না।
এটি সেই লেখার জন্য, যা আপনি ছবি নয়, নোট হিসেবে রাখতে চান: বইয়ের বা হ্যান্ডআউটের একটি পাতা, প্রজেক্টরের একটি স্লাইড, পরিষ্কার বড় হাতের অক্ষরে লেখা হোয়াইটবোর্ডের সারাংশ, ছাপা রেসিপি, পণ্যের লেবেল, একটি ফর্ম বা পোস্টারের একটি অনুচ্ছেদ। শনাক্ত করা লেখা সম্পাদনযোগ্য Markdown হিসেবে আসে — Obsidian, Notion, GitHub issue বা যেকোনো সাদামাটা টেক্সট নোটবুকের জন্য তৈরি।
এর পরিধি ইচ্ছে করেই সীমিত রাখা হয়েছে। এটি শুধু ছাপা লেখা পড়ে, আপনার বাছাই করা ভাষা আর ঐচ্ছিক দ্বিতীয় ভাষায়; চোখে দেখা কাঠামো — অনুচ্ছেদ, বুলেট তালিকা, সংখ্যাযুক্ত তালিকা, বড় শিরোনাম আর রেখাযুক্ত টেবিল — Markdown-এ ধরে রাখে, আর কলাম, হাতের লেখা ও গাণিতিক সূত্রকে আনুমানিক লেখা হিসেবে রেখে দেয়, যা আপনার লাইন ধরে ধরে যাচাই করা উচিত। Image to Markdown, image to MD, photo to Markdown, screenshot to Markdown, JPG to Markdown, ছবি থেকে OCR লেখা: নাম আলাদা, কাজ একটাই, আর ফলাফল সবসময় সেই Markdown, যা ভরসা করার আগে আপনি একবার দেখে নেন।
Image to Markdown: ছবিকে Markdown-এ বদলানোর ধাপ
- একটি ছবি বেছে নিনছাপা লেখা আছে এমন ছবি বা স্ক্রিনশট বেছে নিন, টুলের ওপর টেনে ছাড়ুন বা Ctrl+V / ⌘V দিয়ে ক্লিপবোর্ড থেকে পেস্ট করুন। JPG, PNG, WebP, iPhone-এর HEIC আর TIFF সবই আপনার ডিভাইসেই পড়া হয়; পাতাটি ছবি আর তার মাপ দেখায়, কিছু আপলোড করে না।
- ভাষা মিলিয়ে শনাক্ত করুনছাপা লেখার ভাষা বেছে নিন (মেনু এই পাতার ভাষা আগেই বেছে রাখে), পাতায় দুটি ভাষা থাকলে দ্বিতীয়টি যোগ করুন, আর “লেখা শনাক্ত করুন” চাপুন। প্রথমবার OCR ইঞ্জিন (প্রায় ১.৫ MB) আর দরকারি ভাষার প্যাক (প্রতিটি ০.৪–৩ MB) ডাউনলোড হয়, তারপর ক্যাশে থাকে। আপনার ডিভাইসেই লেখা পড়া হয়, আর প্রোগ্রেস বারে অগ্রগতি দেখা যায়।
- যাচাই করুন, কপি বা ডাউনলোড করুনMarkdown ছবির পাশে সম্পাদনযোগ্য বাক্সে আসে, শব্দ বা অক্ষরের সংখ্যা আর গড় কনফিডেন্স স্কোরসহ। ইঞ্জিন যা ভুল পড়েছে তা ঠিক করুন, তারপর ক্লিপবোর্ডে কপি করুন বা .md ফাইল ডাউনলোড করুন।
কী Markdown হয়, আর কী হয় না
প্রতিটি ছাপা অনুচ্ছেদ একটি Markdown অনুচ্ছেদ হয়: লাইন-বিরতি জুড়ে দেওয়া হয় আর লাইনের শেষে হাইফেনে ভাঙা শব্দ আবার জোড়া লাগে; চীনা, জাপানি ও থাই লাইনগুলো মাঝখানে ফাঁক না ঢুকিয়ে জোড়া হয় আর শব্দের বদলে অক্ষরে গোনা হয়। বুলেট চিহ্ন দিয়ে শুরু লাইন তালিকা হয়; 1., 2., 3. দিয়ে — বা পূর্ব এশীয় লেখায় 一、二、三 আর 1、2、3 দিয়ে — শুরু লাইন সংখ্যাযুক্ত তালিকা হয়; আর একা একটি ছোট লাইন, যা মূল লেখার চেয়ে স্পষ্টতই বড় করে ছাপা বা পুরোটা বড় হাতের অক্ষরে, দ্বিতীয় স্তরের শিরোনাম হয়। বাকি সব পড়ার ক্রমে সাদামাটা লেখা থাকে।
দাগ দিয়ে আঁকা টেবিল Markdown টেবিল হয়: শনাক্ত করার আগে গ্রিড মুছে ফেলা হয়, প্রতিটি ছাপা লাইন টেবিলের সারি হয় আর সারিগুলোর সাধারণ ফাঁক কলাম হয়; তাই মার্জ করা সেল আর দাগহীন টেবিল লেখার লাইন হিসেবে বেরোয়। গাণিতিক সূত্র চেনা হয় না — ভগ্নাংশ, ঘাত আর চিহ্ন এলোমেলো হয়ে যায়; দুই কলামের বিন্যাস পরস্পর জড়িয়ে যেতে পারে; হাতের লেখা, ডেকোরেটিভ ফন্ট, খুব ছোট অক্ষর আর ব্যস্ত পটভূমির লেখা ঠিকমতো পড়া যায় না বা বাদ পড়ে। সংখ্যা, নাম আর কোড আরেকবার দেখে নেওয়ার মতো: সেখানে একটি অক্ষরের ভুলও সাধারণ অনুচ্ছেদের ভুলের চেয়ে বেশি গুরুত্বপূর্ণ। ফলাফলের নিচের গড় কনফিডেন্স ইঞ্জিনের নিজের অনুমান, কোনো প্রতিশ্রুতি নয়।
ফোনের ছবি থেকে পরিষ্কার ফল পেতে
অক্ষর চেনা সবচেয়ে ভালো কাজ করে সমতল পাতায় পরিষ্কার, সমান আলোয় থাকা লেখার সোজাসুজি তোলা ছবিতে — প্রায় ৩০০ dpi স্ক্যানের মতো স্পষ্টতায়। ফ্রেম লেখা দিয়ে ভরুন, ছায়া আর ঝলক এড়ান, আর ফোকাস হওয়া পর্যন্ত ফোন স্থির রাখুন। খুব বড় ছবি শনাক্ত করার আগে লম্বা দিকে ২৬০০ px-এ ছোট করা হয়; বই আর সাধারণ নথির লেখা পুরোপুরি পড়ার মতো থাকে, মেমরি আর সময় বাঁচে।
পাতা বাঁকা বা ছায়াপড়া হলে আগে LensUp স্ক্যানারে প্রক্রিয়া করুন: পার্সপেক্টিভ সংশোধন আর ছায়া মোছায় উচ্চ-কনট্রাস্টের সমতল পাতা মেলে, আর স্ক্যানার থেকে ডাউনলোড করা JPG বা PNG এখানে ভালো ইনপুট। স্ক্রিনশটও সরাসরি পড়া হয় — সাধারণত সবচেয়ে সহজ ক্ষেত্র।
লোকাল ইঞ্জিন যথেষ্ট না হলে: Pro দিয়ে ঠিক করুন
বিনামূল্যের সংস্করণের পেছনের ওপেন-সোর্স ইঞ্জিন Tesseract গাণিতিক সূত্র পড়ে না আর দাগহীন বা মার্জ করা সেলের টেবিলে আটকে যায়। এমন পাতার জন্য ফলাফলের বাক্স “Pro দিয়ে ঠিক করুন” দেখাতে পারে — একটি পেইড অপশন, যা সাইটে পেমেন্ট চালু থাকলে আসে: পুরো ছবি একবার, LensUp-এর সার্ভার হয়ে, Mathpix-এ পাঠানো হয় — সূত্র আর টেবিলের জন্য তৈরি একটি বাণিজ্যিক OCR সেবা — আর তার Markdown লোকাল ফলাফলের জায়গা নেয়, সূত্র ডলার চিহ্নের মাঝে LaTeX হিসেবে আর টেবিল Markdown টেবিল হিসেবে আসে। LensUp পথে কিছু সংরক্ষণ করে না (Mathpix ছবিটি নিজের শর্ত অনুযায়ী প্রক্রিয়া করে); লোকাল ফলাফল এক ক্লিকেই ফিরিয়ে আনা যায়।
Pro-তে রানভিত্তিক মূল্য ধরা হয় ঠিক এই কারণে, যাতে বিনামূল্যের সংস্করণ বিনামূল্যে আর লোকাল থাকে: যতদিন এটি আছে, ইমেইল লিংকে সাইন ইন করুন (পাসওয়ার্ড নেই), ৫০টি রান ৪.৯৯ মার্কিন ডলারের এককালীন পেমেন্টে কিনুন (কোনো সাবস্ক্রিপশন নেই), আর প্রতিটি Pro সংশোধনে একটি রান খরচ হয়। সেবাদাতার দিকের ত্রুটিতে রান ব্যর্থ হলে আপনার কোনো রান কাটা হয় না।
মিশ্র ভাষার লেখা ডিভাইসেই শনাক্ত করা হয়
এই টুলে ২১টি ভাষা পাওয়া যায়: ইংরেজি, ফরাসি, জার্মান, স্প্যানিশ, পর্তুগিজ, ইতালীয়, পোলিশ, তুর্কি, ইন্দোনেশীয়, ভিয়েতনামি, চীনা (সরলীকৃত ও ঐতিহ্যবাহী), জাপানি, কোরীয়, রুশ, আরবি, ফারসি, উর্দু, হিন্দি, বাংলা আর থাই — সেই ভাষাগুলোই, যেগুলোয় LensUp নিজে কথা বলে। প্রতিটি ভাষা আলাদা প্যাক, যা আপনি বাছলে তবেই ডাউনলোড হয়: ফরাসি পাতার জন্য ০.৭ MB-র প্যাক, চীনা ভাষার জন্য প্রায় ১.৭ MB, কখনও পুরো সেট নয়। যে ভাষা সত্যিই ছাপা আছে সেটিই বাছুন আর পাতায় দুটি ভাষা থাকলে দ্বিতীয়টি যোগ করুন; কোরীয়, রুশ, আরবি, ফারসি, উর্দু, হিন্দি, বাংলা আর থাইয়ের সঙ্গে ইংরেজি স্বয়ংক্রিয়ভাবে লোড হয়, কারণ এই প্যাকগুলো একা ইংরেজি শব্দকে দেখতে কাছাকাছি অক্ষরে বদলে দেয়। ভুল প্যাকে Markdown-এর বদলে টুকরো বেরোয়, স্ট্যাটাস লাইন তা জানায়, আর “ভাষা শনাক্ত করুন” প্রতিটি লিপির একটি করে প্যাক পরখ করে ঠিক প্যাকটি খুঁজে নেয় — তাই মিশ্র ভাষার পাতাও পরিষ্কার Markdown হয়।
সবই ওপেন-সোর্স ইঞ্জিনে লোকালি চলে, যেমন LensUp অন্য ছবি প্রক্রিয়া করে: আপলোড নেই, অ্যাকাউন্ট নেই, কোনো সার্ভারে আপনার ছবি বা তার লেখার কপি নেই। ইঞ্জিনের ফাইল আর প্যাক lensup.ai থেকে আসে আর ব্রাউজার সেগুলো ক্যাশ করে, তাই একই ভাষায় পরেরবার শনাক্তকরণ সঙ্গে সঙ্গে শুরু হয়। স্ক্যানার টুলগুলোয় এখনও কোনো OCR নেই আর সেগুলো অনুসন্ধানযোগ্য PDF বানায় না।
প্রায়ই জিজ্ঞাসিত প্রশ্ন
Image to Markdown-এ বদলানোর সময় ছবি কি আমার ডিভাইস ছেড়ে যায়?
বিনামূল্যের সংস্করণে না: OCR ইঞ্জিন আর আপনার বাছা ভাষার প্যাক ব্রাউজারে ডাউনলোড হয় আর শনাক্তকরণের কাজ সেখানেই হয়, তাই ছবি, শনাক্ত করা লেখা আর .md ফাইল — কিছুই LensUp-এর সার্ভারে পৌঁছায় না। শুধু একটি স্পষ্ট ব্যতিক্রম আছে, আর সেটিও আপনার নিজের বাছাইয়ে: ফলাফলের বাক্স যখন “Pro দিয়ে ঠিক করুন” দেখায় (পেমেন্ট চালু থাকলে আসা পেইড অপশন), সেই ক্লিকে পুরো ছবি LensUp হয়ে Mathpix-এ (সূত্র আর টেবিলের বাণিজ্যিক OCR সেবা) যায় আর তার Markdown ফিরে আসে; LensUp পথে কিছু সংরক্ষণ করে না (Mathpix ছবিটি নিজের শর্ত অনুযায়ী প্রক্রিয়া করে), ইমেইল সাইন-ইন আর পেইড ক্রেডিট লাগে (৫০টি রান ৪.৯৯ মার্কিন ডলারে, একবার), আর লোকাল ফলাফল ফিরিয়ে আনা যায়।
এই image to markdown converter কোন কোন ভাষা পড়ে?
ছাপা লেখার একুশটি ভাষা: ইংরেজি, ফরাসি, জার্মান, স্প্যানিশ, পর্তুগিজ, ইতালীয়, পোলিশ, তুর্কি, ইন্দোনেশীয়, ভিয়েতনামি, চীনা (সরলীকৃত ও ঐতিহ্যবাহী), জাপানি, কোরীয়, রুশ, আরবি, ফারসি, উর্দু, হিন্দি, বাংলা আর থাই। একটি পাতায় এই ভাষাগুলোর মধ্যে দুটি থাকতে পারে: মূল ভাষা বাছুন, মিশ্র পাতার জন্য দ্বিতীয়টি যোগ করুন, আর কোরীয়, রুশ, আরবি, ফারসি, উর্দু, হিন্দি, বাংলা আর থাইয়ের সঙ্গে ইংরেজি স্বয়ংক্রিয়ভাবে পড়া হয়, কারণ এই প্যাকগুলো একা ইংরেজি শব্দকে দেখতে কাছাকাছি অক্ষরে বদলে দেয়। হাতের লেখা কোনো ভাষায় সমর্থিত নয়।
কিছু লেখা ভুল বা বাদ কেন?
প্রথমে ভাষার প্যাক দেখুন: Markdown-এর নিচের সতর্কবার্তায় “ভাষা শনাক্ত করুন” আছে, যা প্রতিটি লিপির একটি করে OCR প্যাক পরখ করে সেরাটি রাখে। তারপর ছবি: ঝাপসা, ঝলক, ছায়া, বাঁক, ছোট অক্ষর, ডেকোরেটিভ ফন্ট আর ব্যস্ত পটভূমি — সবই শনাক্তকরণের মান কমায়, আর টেবিল বা বহু কলামের পাতা ভুল ক্রমে আসতে পারে। পাতা সমতল রেখে পরিষ্কার ও স্পষ্ট ছবি আবার তুলুন, বা আগে স্ক্যানারে পরিষ্কার করুন, তারপর ব্যবহারের আগে Markdown যাচাই করুন।