OCR ฟรีในเครื่อง · 21 ภาษา · ปนหลายภาษา · ไม่ต้องอัปโหลด
แปลงรูปเป็น Markdown (OCR)
ตัวแปลงรูปเป็น Markdown นี้เปลี่ยนรูปถ่ายหรือภาพหน้าจอที่มีตัวพิมพ์ให้เป็น Markdown โดยไม่ส่งรูปไปที่ไหนทั้งสิ้น เอนจิน OCR ทำงานอยู่ในเบราว์เซอร์ของคุณ รองรับ 21 ภาษา และอ่านหน้าที่ปนหลายภาษาได้: คุณเลือกภาษาหลักของข้อความ เพิ่มภาษาที่สองถ้าจำเป็น และระบบจะโหลดแพ็กภาษาอังกฤษให้อัตโนมัติเมื่อแพ็กภาษาที่เลือกอ่านคำภาษาอังกฤษไม่ได้ รูปอยู่บนเครื่องของคุณตลอด และเมื่อเอนจินกับแพ็กภาษาที่ใช้ดาวน์โหลดแล้วครั้งหนึ่ง ตัวแปลงก็ทำงานได้แม้ไม่มีอินเทอร์เน็ต
รูป → Markdown
เลือกรูปที่มีข้อความพิมพ์ 1 รูป
เลือกรูปถ่ายหรือภาพหน้าจอที่เบราว์เซอร์อ่านได้ วางที่นี่ หรือวางด้วย Ctrl+V / ⌘V LensUp ไม่อัปโหลดมัน
ตัวพิมพ์เท่านั้น หน้าหนึ่งมีได้สองภาษา: เลือกภาษาหลัก เพิ่มภาษาที่สอง และระบบจะเพิ่มภาษาอังกฤษให้กับชุดอักษรที่จำเป็นต้องใช้ ตารางที่มีเส้นกลายเป็นตาราง Markdown ผลลัพธ์จากลายมือ ตารางไม่มีเส้น สูตร และเลย์เอาต์หลายคอลัมน์อาจคลาดเคลื่อน — ตรวจก่อนเชื่อ
Pro ส่งรูปนี้ทั้งรูปครั้งเดียว ผ่านเซิร์ฟเวอร์ LensUp ไปยัง Mathpix — ตัวรู้จำเชิงพาณิชย์ที่อ่านสูตรและตารางได้ — แล้วแทนที่ Markdown ด้วยผลลัพธ์ของมัน (สูตรเป็น $…$) LensUp ไม่เก็บรูป ส่วน Mathpix ประมวลผลตามเงื่อนไขของตนเอง ใช้ Pro หนึ่งครั้งหักหนึ่งเครดิต แพ็ก 50 เครดิตราคา US$4.99 ชำระครั้งเดียวและไม่มีค่าสมัครสมาชิก
แปลงรูปเป็น Markdown ทำอย่างไร?
เปิดตัวแปลงรูปเป็น Markdown เลือกรูปถ่ายหรือภาพหน้าจอที่มีตัวพิมพ์ ตรวจภาษาของข้อความ แล้วกด “อ่านข้อความ” LensUp จะรัน OCR บนเครื่องของคุณเอง — พร้อมภาษาที่สองถ้าหน้านั้นปนสองภาษา และแพ็กอังกฤษสำหรับชุดอักษรที่ต้องใช้ — แล้วเปลี่ยนย่อหน้า หัวข้อย่อย และรายการแบบมีลำดับเป็นบล็อก Markdown ผลลัพธ์แก้ไข คัดลอก หรือดาวน์โหลดเป็น .md ได้ รูปไม่ถูกอัปโหลดเลย
เครื่องมือนี้เหมาะกับข้อความที่คุณอยากเก็บเป็นโน้ต ไม่ใช่เก็บเป็นรูป: หน้าหนังสือหรือเอกสารแจก สไลด์บนโปรเจกเตอร์ สรุปบนไวต์บอร์ดที่เขียนตัวพิมพ์ใหญ่เรียบร้อย สูตรอาหารที่พิมพ์ไว้ ฉลากสินค้า แบบฟอร์ม หรือย่อหน้าบนโปสเตอร์ ข้อความที่อ่านได้จะมาเป็น Markdown ที่แก้ไขได้ พร้อมนำไปวางใน Obsidian, Notion, issue บน GitHub หรือแอปจดโน้ตแบบข้อความล้วนใดก็ได้
เครื่องมือนี้ตั้งใจจำกัดขอบเขตให้แคบ มันอ่านเฉพาะตัวพิมพ์ ในภาษาหลักที่คุณเลือกและภาษาที่สองซึ่งเลือกเพิ่มได้อีกหนึ่งภาษา รักษาโครงสร้างที่มองเห็น — ย่อหน้า รายการหัวข้อย่อย รายการแบบมีลำดับ หัวเรื่องตัวใหญ่ และตารางที่มีเส้น — ไว้ใน Markdown ส่วนคอลัมน์ ลายมือ และสูตรคณิตศาสตร์จะออกมาเป็นข้อความโดยประมาณที่คุณควรไล่ตรวจทีละบรรทัด แปลงรูปเป็น Markdown, รูปเป็น MD, ภาพถ่ายเป็น Markdown, ภาพหน้าจอเป็น Markdown, JPG เป็น Markdown, OCR รูปเป็นข้อความ: ชื่อเรียกต่างกัน แต่งานเดียวกัน และผลลัพธ์จะเป็น Markdown ที่คุณควรตรวจสอบก่อนนำไปใช้ทุกครั้ง
วิธีแปลงรูปเป็น Markdown
- เลือกรูปหนึ่งรูปเลือกรูปถ่ายหรือภาพหน้าจอที่มีตัวพิมพ์ ลากมาวางบนเครื่องมือ หรือวางจากคลิปบอร์ดด้วย Ctrl+V / ⌘V ไฟล์ JPG, PNG, WebP, HEIC จาก iPhone และ TIFF จะถูกอ่านบนเครื่อง หน้านี้เพียงแสดงรูปและขนาดไฟล์โดยไม่อัปโหลดอะไร
- ตรวจภาษาแล้วอ่านเลือกภาษาของตัวพิมพ์ (เมนูเลือกภาษาของหน้านี้ไว้ให้แล้ว) เพิ่มภาษาที่สองถ้าหน้านั้นปนสองภาษา แล้วกด “อ่านข้อความ” ครั้งแรกจะดาวน์โหลดเอนจิน OCR (ราว 1.5 MB) กับแพ็กภาษาที่ต้องใช้ (แพ็กละ 0.4–3 MB) แล้วเก็บไว้ในแคช การอ่านเกิดขึ้นบนเครื่องของคุณพร้อมแถบความคืบหน้า
- ตรวจ คัดลอก หรือดาวน์โหลดMarkdown จะขึ้นในกล่องที่แก้ไขได้ข้างรูป พร้อมจำนวนคำหรือตัวอักษรและความมั่นใจเฉลี่ย แก้จุดที่เอนจินอ่านผิด แล้วคัดลอกไปคลิปบอร์ดหรือดาวน์โหลดเป็นไฟล์ .md
อะไรแปลงเป็น Markdown ได้ และอะไรไม่ได้
ข้อความพิมพ์แต่ละย่อหน้าจะกลายเป็นย่อหน้า Markdown หนึ่งย่อหน้า: ระบบจะรวมบรรทัดที่ต่อเนื่องกัน และเชื่อมคำที่ตัดด้วยยัติภังค์ท้ายบรรทัดกลับเข้าด้วยกัน บรรทัดจีน ญี่ปุ่น และไทยต่อกันโดยไม่เว้นวรรค และนับเป็นตัวอักษรแทนคำ บรรทัดที่ขึ้นต้นด้วยเครื่องหมายหัวข้อกลายเป็นรายการ บรรทัดที่ขึ้นต้นด้วย 1., 2., 3. — หรือ 一、二、三 และ 1、2、3 ในข้อความเอเชียตะวันออก — กลายเป็นรายการแบบมีลำดับ ส่วนบรรทัดสั้นที่อยู่โดดๆ และมีตัวอักษรใหญ่กว่าเนื้อความอย่างชัดเจน หรือเป็นตัวพิมพ์ใหญ่ทั้งหมด จะกลายเป็นหัวเรื่องระดับสอง ที่เหลือคงเป็นข้อความธรรมดาตามลำดับการอ่าน
ตารางที่ตีเส้นกลายเป็นตาราง Markdown: เส้นตารางถูกลบก่อนอ่าน แต่ละบรรทัดที่พิมพ์กลายเป็นแถว และช่องว่างที่ทุกแถวมีร่วมกันกลายเป็นคอลัมน์ ดังนั้นเซลล์ที่ผสานกันและตารางไม่มีเส้นจะออกมาเป็นบรรทัดข้อความ สูตรคณิตศาสตร์ไม่ถูกอ่าน — เศษส่วน เลขยกกำลัง และสัญลักษณ์อาจอ่านเพี้ยน เลย์เอาต์สองคอลัมน์อาจสลับกัน ลายมือ ฟอนต์ประดิษฐ์ ตัวเล็กมาก และข้อความบนพื้นหลังรกอ่านได้แย่หรือหายไป ตัวเลข ชื่อ และรหัสควรดูซ้ำอีกรอบ: ข้อผิดพลาดเพียงตัวเดียวในข้อมูลเหล่านี้อาจส่งผลมากกว่าข้อผิดพลาดในเนื้อความทั่วไป ความมั่นใจเฉลี่ยใต้ผลลัพธ์คือการประเมินของเอนจินเอง ไม่ใช่คำรับประกัน
ถ่ายด้วยมือถืออย่างไรให้ OCR อ่านได้ชัด
การรู้จำตัวอักษรทำงานได้ดีที่สุดกับหน้ากระดาษที่วางราบ ตัวอักษรคมชัด แสงสม่ำเสมอ และถ่ายตรงจากด้านหน้า ด้วยความชัดราวสแกน 300 dpi ให้ข้อความเต็มเฟรม เลี่ยงเงาและแสงสะท้อน และถือนิ่งจนโฟกัสล็อก รูปที่ใหญ่มากจะถูกย่อให้ด้านยาว 2600 px ก่อนอ่าน ตัวพิมพ์ในหนังสือและเอกสารทั่วไปยังอ่านได้ครบ แต่ประหยัดหน่วยความจำและเวลา
ถ้าหน้ากระดาษเอียงหรือมีเงา ให้ผ่านสแกนเนอร์ LensUp ก่อน: การแก้มุมมองและการลบเงาจะได้หน้ากระดาษที่เรียบและมีคอนทราสต์สูง และ JPG หรือ PNG ที่ดาวน์โหลดจากสแกนเนอร์เหมาะสำหรับนำมาอ่านต่อในเครื่องมือนี้ ตัวอ่านรับภาพหน้าจอด้วย ซึ่งมักเป็นกรณีที่ง่ายที่สุด
เมื่อเอนจินในเครื่องไม่พอ: แก้ด้วย Pro
Tesseract เอนจินโอเพนซอร์สที่ใช้ในโหมดฟรี อ่านสัญลักษณ์คณิตศาสตร์ไม่ได้ และมีปัญหากับตารางไม่มีเส้นหรือเซลล์ผสาน สำหรับหน้าแบบนั้น กล่องผลลัพธ์อาจเสนอ “แก้ด้วย Pro” — ตัวเลือกแบบเสียเงินที่ปรากฏเมื่อเปิดรับชำระเงินบนเว็บ: รูปทั้งรูปถูกส่งครั้งเดียว ผ่านเซิร์ฟเวอร์ LensUp ไปยัง Mathpix — ระบบ OCR เชิงพาณิชย์ที่ออกแบบมาสำหรับสูตรและตาราง — และ Markdown ของมันแทนที่ผลลัพธ์ในเครื่อง โดยสูตรเป็น LaTeX ระหว่างเครื่องหมายดอลลาร์และตารางเป็นตาราง Markdown LensUp ไม่เก็บรูปไว้ระหว่างการส่งต่อ (Mathpix ประมวลผลตามเงื่อนไขของตนเอง) และคุณเรียกคืนผลลัพธ์ที่ประมวลผลในเครื่องได้ในคลิกเดียว
Pro คิดเงินเป็นรายครั้งก็เพื่อให้เส้นทางฟรียังฟรีและอยู่ในเครื่อง: ตราบที่ยังเปิดให้ใช้ คุณเข้าสู่ระบบด้วยลิงก์ทางอีเมล (ไม่มีรหัสผ่าน) ซื้อแพ็ก 50 เครดิตในราคา US$4.99 แบบจ่ายครั้งเดียว ไม่มีค่าสมัครสมาชิก และการแก้ด้วย Pro แต่ละครั้งใช้หนึ่งเครดิต หากผู้ให้บริการประมวลผลไม่สำเร็จ ระบบจะไม่หักเครดิต
รองรับหลายภาษาในหน้าเดียว โดยประมวลผลบนเครื่อง
หน้านี้ให้ 21 ภาษา: อังกฤษ ฝรั่งเศส เยอรมัน สเปน โปรตุเกส อิตาลี โปแลนด์ ตุรกี อินโดนีเซีย เวียดนาม จีนตัวย่อและจีนตัวเต็ม ญี่ปุ่น เกาหลี รัสเซีย อาหรับ เปอร์เซีย อูรดู ฮินดี เบงกอล และไทย — ซึ่งเป็นภาษาที่ LensUp รองรับ แต่ละภาษาเป็นแพ็กแยกที่ดาวน์โหลดเฉพาะเมื่อคุณเลือก: หน้าฝรั่งเศสใช้แพ็ก 0.7 MB หน้าจีนราว 1.7 MB ไม่มีทางโหลดทั้งชุด เลือกภาษาที่พิมพ์อยู่จริงและเพิ่มภาษาที่สองเมื่อหน้านั้นปนกัน อังกฤษโหลดให้เองพร้อมเกาหลี รัสเซีย อาหรับ เปอร์เซีย อูรดู ฮินดี เบงกอล และไทย เพราะแพ็กเหล่านั้นเมื่ออยู่ลำพังจะเปลี่ยนคำอังกฤษเป็นตัวอักษรที่หน้าตาคล้ายกัน หากเลือกแพ็กผิด ข้อความจะกระจัดกระจายและไม่เป็น Markdown ที่อ่านรู้เรื่อง บรรทัดสถานะจะบอก และ “ตรวจหาภาษา” จะหาแพ็กที่ถูกโดยลองชุดอักษรละหนึ่งแพ็ก — หน้าที่ปนหลายภาษาจึงยังกลายเป็น Markdown สะอาดๆ
ทั้งหมดรันในเครื่องด้วยเอนจินโอเพนซอร์ส เหมือนที่ LensUp ประมวลผลรูปอื่นๆ: ไม่อัปโหลด ไม่มีบัญชี ไม่มีสำเนารูปหรือข้อความของคุณบนเซิร์ฟเวอร์ใด ไฟล์เอนจินและแพ็กเสิร์ฟจาก lensup.ai และเบราว์เซอร์แคชไว้ การอ่านครั้งที่สองในภาษาเดิมจึงเริ่มทันที เครื่องมือสแกนเนอร์ยังคงไม่มี OCR และไม่สร้าง PDF ที่ค้นหาได้
คำถามที่พบบ่อย
ตอนแปลงรูปเป็น Markdown รูปออกจากเครื่องของฉันไหม?
สำหรับการใช้งานฟรี รูปจะไม่ออกจากเครื่องของคุณ: เอนจิน OCR และแพ็กภาษาที่คุณเลือกถูกดาวน์โหลดลงเบราว์เซอร์ และการอ่านเกิดขึ้นตรงนั้น รูป ข้อความที่อ่านได้ และไฟล์ .md จึงไม่เคยไปถึงเซิร์ฟเวอร์ LensUp มีข้อยกเว้นเพียงอย่างเดียว ซึ่งระบบจะแจ้งไว้อย่างชัดเจนและเป็นการเลือกของคุณเอง: เมื่อกล่องผลลัพธ์เสนอ “แก้ด้วย Pro” (ตัวเลือกเสียเงินที่ปรากฏเมื่อเปิดรับชำระเงิน) การคลิกนั้นส่งรูปทั้งรูปผ่าน LensUp ไปยัง Mathpix (ตัวรู้จำเชิงพาณิชย์สำหรับสูตรและตาราง) แล้วนำ Markdown ของมันกลับมา LensUp ไม่เก็บรูปไว้ระหว่างการส่งต่อ (Mathpix ประมวลผลตามเงื่อนไขของตนเอง) ต้องเข้าสู่ระบบด้วยอีเมลและมีเครดิตแบบเสียเงิน (50 เครดิต US$4.99 จ่ายครั้งเดียว) และผลลัพธ์ในเครื่องเรียกคืนได้
ตัวแปลงรูปเป็น Markdown รองรับภาษาอะไรบ้าง?
รองรับข้อความตัวพิมพ์ 21 ภาษา: อังกฤษ ฝรั่งเศส เยอรมัน สเปน โปรตุเกส อิตาลี โปแลนด์ ตุรกี อินโดนีเซีย เวียดนาม จีนตัวย่อและจีนตัวเต็ม ญี่ปุ่น เกาหลี รัสเซีย อาหรับ เปอร์เซีย อูรดู ฮินดี เบงกอล และไทย หน้าหนึ่งมีได้สองภาษา: เลือกภาษาหลัก เพิ่มภาษาที่สองสำหรับหน้าที่ปนกัน และอังกฤษถูกอ่านให้เองพร้อมเกาหลี รัสเซีย อาหรับ เปอร์เซีย อูรดู ฮินดี เบงกอล และไทย เพราะแพ็กเหล่านั้นเมื่ออยู่ลำพังจะเปลี่ยนคำอังกฤษเป็นตัวอักษรที่หน้าตาคล้ายกัน ไม่รองรับลายมือในภาษาใดเลย
ทำไมข้อความบางส่วนผิดหรือหายไป?
ตรวจแพ็กภาษาก่อน: คำเตือนใต้ Markdown เสนอ “ตรวจหาภาษา” ซึ่งลองแพ็ก OCR ชุดอักษรละหนึ่งแพ็กแล้วเก็บอันที่ดีที่สุด จากนั้นดูรูป: เบลอ แสงสะท้อน เงา เอียง ตัวเล็ก ฟอนต์ประดิษฐ์ และพื้นหลังรกล้วนลดคุณภาพ และตารางหรือหน้าหลายคอลัมน์อาจออกมาผิดลำดับ ถ่ายใหม่ให้แบนและคม หรือทำความสะอาดในสแกนเนอร์ก่อน แล้วตรวจ Markdown ก่อนใช้