OCR miễn phí trên thiết bị · 21 ngôn ngữ · trang lẫn nhiều thứ tiếng · không tải lên
Chuyển ảnh sang Markdown (OCR)
Công cụ chuyển ảnh sang Markdown này biến một ảnh chụp hoặc ảnh màn hình có chữ in thành Markdown mà không gửi ảnh đi bất cứ đâu. Bộ nhận dạng OCR chạy ngay trong trình duyệt, hỗ trợ 21 ngôn ngữ và cả những trang lẫn nhiều thứ tiếng: bạn chọn ngôn ngữ chính của văn bản, thêm ngôn ngữ thứ hai nếu cần, và gói tiếng Anh sẽ tự động được nạp khi gói của ngôn ngữ đã chọn không đọc được từ tiếng Anh. Ảnh ở lại trên thiết bị, và sau khi bộ nhận dạng cùng các gói ngôn ngữ đã tải về một lần, công cụ vẫn chạy khi không có mạng.
Ảnh → Markdown
Chọn một ảnh có chữ in
Chọn một ảnh chụp hoặc ảnh màn hình mà trình duyệt đọc được, thả vào đây hoặc dán bằng Ctrl+V / ⌘V. LensUp không tải nó lên.
Chỉ chữ in. Một trang có thể có hai ngôn ngữ: chọn ngôn ngữ chính, thêm ngôn ngữ thứ hai, và tiếng Anh được thêm cho hệ chữ nào cần. Bảng có kẻ ô thành bảng Markdown; chữ viết tay, bảng không kẻ ô, công thức và bố cục nhiều cột có thể được nhận dạng không chính xác — kiểm tra trước khi tin dùng.
Pro gửi toàn bộ ảnh này, một lần duy nhất, qua máy chủ LensUp tới Mathpix — bộ nhận dạng thương mại đọc được công thức và bảng — và thay Markdown bằng kết quả của nó (công thức ở dạng $…$). LensUp không lưu ảnh; Mathpix xử lý ảnh theo điều khoản riêng của họ. Mỗi lần sửa dùng một lượt; gói 50 lượt giá 4,99 USD, thanh toán một lần, không phải gói thuê bao.
Làm sao để chuyển ảnh sang Markdown?
Mở công cụ chuyển ảnh sang Markdown, chọn một ảnh chụp hoặc ảnh màn hình có chữ in, kiểm tra ngôn ngữ của chữ rồi bấm “Nhận dạng chữ”. LensUp chạy OCR ngay trên thiết bị của bạn — thêm ngôn ngữ thứ hai nếu trang lẫn hai thứ tiếng, và tự động nạp thêm gói tiếng Anh cho những hệ chữ cần hỗ trợ — rồi biến đoạn văn, gạch đầu dòng và danh sách đánh số thành các khối Markdown; bạn có thể sửa kết quả, sao chép hoặc tải về dạng .md. Ảnh không bao giờ được tải lên.
Công cụ này dành cho những nội dung bạn muốn lưu thành ghi chú thay vì giữ dưới dạng ảnh: một trang sách hay tài liệu phát tay, một slide trên máy chiếu, bản tóm tắt trên bảng viết bằng chữ in hoa ngay ngắn, một công thức nấu ăn in sẵn, nhãn sản phẩm, một biểu mẫu hay một đoạn trên áp phích. Chữ nhận dạng được trả về dưới dạng Markdown có thể chỉnh sửa, sẵn sàng đưa vào Obsidian, Notion, một issue trên GitHub hay bất kỳ sổ ghi chú văn bản thuần nào.
Công cụ chủ ý chỉ tập trung vào chữ in: đọc ngôn ngữ chính bạn chọn và, nếu cần, thêm một ngôn ngữ thứ hai; giữ lại cấu trúc nhìn thấy được — đoạn văn, danh sách gạch đầu dòng, danh sách đánh số, tiêu đề cỡ lớn và bảng có kẻ ô — còn bố cục nhiều cột, chữ viết tay và công thức toán có thể được nhận dạng không chính xác, nên bạn hãy rà từng dòng. Chuyển ảnh sang Markdown, ảnh sang MD, hình sang Markdown, ảnh màn hình sang Markdown, JPG sang Markdown, OCR ảnh ra chữ: dù gọi theo cách nào thì mục đích vẫn như nhau, và kết quả luôn là một bản Markdown bạn xem lại trước khi tin dùng.
Cách chuyển ảnh sang Markdown
- Chọn một ảnhChọn một ảnh chụp hoặc ảnh màn hình có chữ in, kéo thả vào công cụ hoặc dán từ bộ nhớ tạm bằng Ctrl+V / ⌘V. JPG, PNG, WebP, HEIC của iPhone và TIFF đều được đọc trên thiết bị; trang hiển thị ảnh và kích thước mà không tải lên gì cả.
- Kiểm tra ngôn ngữ rồi nhận dạngChọn ngôn ngữ của chữ in (menu đã chọn sẵn ngôn ngữ của trang này), thêm ngôn ngữ thứ hai nếu trang lẫn hai thứ tiếng, rồi bấm “Nhận dạng chữ”. Lần đầu, bộ nhận dạng OCR (khoảng 1,5 MB) và các gói ngôn ngữ cần thiết (mỗi gói 0,4–3 MB) được tải về, sau đó nằm trong bộ nhớ đệm. Việc đọc diễn ra trên thiết bị của bạn, có thanh tiến độ.
- Xem lại, sao chép hoặc tải vềMarkdown hiện trong ô soạn thảo cạnh ảnh, kèm số từ hoặc số ký tự và độ tin cậy trung bình. Sửa những chỗ bộ nhận dạng đọc sai, rồi sao chép vào bộ nhớ tạm hoặc tải về tệp .md.
Nội dung nào được chuyển thành Markdown, nội dung nào không
Mỗi đoạn văn được in sẽ trở thành một đoạn Markdown: các chỗ xuống dòng được nối lại, từ bị ngắt bằng gạch nối ở cuối dòng được ghép lại; dòng chữ Trung, Nhật và Thái được nối không chèn khoảng trắng và đếm theo ký tự thay vì theo từ. Dòng bắt đầu bằng ký hiệu gạch đầu dòng thành danh sách; dòng bắt đầu bằng 1., 2., 3. — hoặc 一、二、三 và 1、2、3 trong văn bản Đông Á — thành danh sách đánh số; và một dòng ngắn đứng riêng, có cỡ chữ lớn hơn rõ rệt so với nội dung chính hoặc toàn chữ hoa, thành tiêu đề cấp hai. Mọi thứ còn lại giữ nguyên là văn bản thuần theo thứ tự đọc.
Bảng có kẻ ô thành bảng Markdown: lưới được xóa trước khi nhận dạng, mỗi dòng in thành một hàng và các khoảng trống chung của các hàng thành cột; vì thế ô gộp và bảng không kẻ ô sẽ ra thành các dòng văn bản. Công thức toán không được nhận dạng — phân số, số mũ và ký hiệu bị rối; bố cục hai cột có thể đan vào nhau; chữ viết tay, phông trang trí, chữ rất nhỏ và chữ trên nền rối đọc kém hoặc bị bỏ qua. Số, tên và mã đáng được xem lại lần nữa: một ký tự sai trong những dữ liệu này có thể gây hậu quả lớn hơn lỗi trong văn bản thông thường. Độ tin cậy trung bình dưới kết quả là ước lượng của chính bộ nhận dạng, không phải lời cam kết.
Cách chụp bằng điện thoại để OCR nhận dạng rõ
Nhận dạng ký tự hoạt động tốt nhất với trang giấy phẳng, chữ sắc nét, ánh sáng đều và ảnh được chụp chính diện, độ nét cỡ bản quét 300 dpi. Để chữ chiếm trọn khung hình, tránh bóng và chói, giữ yên máy đến khi lấy nét xong. Ảnh quá lớn được thu về 2600 px ở cạnh dài trước khi nhận dạng — chữ sách vở và tài liệu thông thường vẫn đọc rõ hoàn toàn, lại tiết kiệm bộ nhớ và thời gian.
Nếu trang bị nghiêng hoặc có bóng, hãy xử lý bằng công cụ quét của LensUp trước: chỉnh phối cảnh và xóa bóng cho ra một trang phẳng, tương phản cao, và tệp JPG hay PNG tải từ máy quét rất phù hợp để nhận dạng bằng công cụ này. Bộ nhận dạng cũng nhận ảnh màn hình, thường là trường hợp dễ nhất.
Khi bộ nhận dạng trên thiết bị chưa đủ: sửa bằng Pro
Tesseract, bộ nhận dạng mã nguồn mở được dùng trong chế độ miễn phí, không đọc được ký hiệu toán và chật vật với bảng không kẻ ô hoặc ô gộp. Với những trang như vậy, ô kết quả có thể đưa ra “Sửa bằng Pro” — tùy chọn trả phí xuất hiện khi thanh toán được bật trên trang: toàn bộ ảnh được gửi một lần, qua máy chủ LensUp, tới Mathpix — bộ nhận dạng thương mại chuyên cho công thức và bảng — và Markdown của nó thay thế kết quả trên thiết bị, công thức ở dạng LaTeX giữa hai ký hiệu đô la, bảng ở dạng bảng Markdown. LensUp không lưu ảnh trong quá trình gửi (Mathpix xử lý ảnh theo điều khoản riêng của họ); kết quả trên thiết bị có thể khôi phục chỉ với một cú bấm.
Pro tính phí theo lượt để bản miễn phí luôn được xử lý ngay trên thiết bị và mãi miễn phí: khi còn được cung cấp, bạn đăng nhập bằng liên kết qua email (không mật khẩu), mua gói 50 lượt với giá 4,99 USD, thanh toán một lần và không đăng ký thuê bao; mỗi lần sửa bằng Pro dùng một lượt. Nếu nhà cung cấp xử lý thất bại, bạn không bị trừ lượt.
Chủ động hỗ trợ trang đa ngôn ngữ ngay trên thiết bị
Trang hỗ trợ 21 ngôn ngữ: tiếng Anh, tiếng Pháp, tiếng Đức, tiếng Tây Ban Nha, tiếng Bồ Đào Nha, tiếng Ý, tiếng Ba Lan, tiếng Thổ Nhĩ Kỳ, tiếng Indonesia, tiếng Việt, tiếng Trung (chữ giản thể và phồn thể), tiếng Nhật, tiếng Hàn, tiếng Nga, tiếng Ả Rập, tiếng Ba Tư, tiếng Urdu, tiếng Hindi, tiếng Bengali và tiếng Thái — Đây cũng là các ngôn ngữ LensUp hỗ trợ. Mỗi ngôn ngữ là một gói riêng, chỉ tải khi bạn chọn: một trang tiếng Pháp cần gói 0,7 MB, một trang tiếng Trung khoảng 1,7 MB, không bao giờ tải cả bộ. Hãy chọn đúng ngôn ngữ được in và thêm ngôn ngữ thứ hai khi trang lẫn hai thứ tiếng; tiếng Anh tự được nạp kèm tiếng Hàn, tiếng Nga, tiếng Ả Rập, tiếng Ba Tư, tiếng Urdu, tiếng Hindi, tiếng Bengali và tiếng Thái, vì gói của các tiếng này đứng một mình sẽ biến từ tiếng Anh thành những chữ cái trông na ná. Đọc bằng gói sai sẽ cho ra văn bản rời rạc thay vì Markdown hoàn chỉnh, dòng trạng thái sẽ báo, và “Nhận diện ngôn ngữ” tìm đúng gói bằng cách thử mỗi hệ chữ một gói — nên trang lẫn nhiều thứ tiếng cũng thành Markdown sạch.
Mọi thứ chạy trên thiết bị bằng bộ nhận dạng mã nguồn mở, giống cách LensUp xử lý các ảnh khác: không tải lên, không cần tài khoản và không có bản sao ảnh hay văn bản của bạn trên bất kỳ máy chủ nào. Tệp bộ nhận dạng và các gói được phát từ lensup.ai và trình duyệt lưu đệm, nên lần nhận dạng thứ hai cùng ngôn ngữ bắt đầu ngay. Các công cụ quét vẫn không có OCR và không tạo tệp PDF có thể tìm kiếm.
Câu hỏi thường gặp
Khi chuyển ảnh sang Markdown, ảnh có rời khỏi thiết bị của tôi không?
Đường miễn phí thì không: bộ nhận dạng OCR và gói ngôn ngữ bạn chọn được tải vào trình duyệt và việc nhận dạng diễn ra ở đó, nên ảnh, chữ nhận dạng được và tệp .md không bao giờ tới máy chủ LensUp. Ngoại lệ duy nhất là rõ ràng và do bạn chọn: khi ô kết quả đưa ra “Sửa bằng Pro” (tùy chọn trả phí xuất hiện khi thanh toán được bật), cú bấm đó gửi toàn bộ ảnh qua LensUp tới Mathpix (bộ nhận dạng thương mại cho công thức và bảng) và lấy về Markdown của nó; LensUp không lưu ảnh trong quá trình gửi (Mathpix xử lý ảnh theo điều khoản riêng của họ), cần đăng nhập bằng email và lượt trả phí (50 lượt giá 4,99 USD, mua một lần), và kết quả trên thiết bị có thể khôi phục.
Công cụ chuyển ảnh sang Markdown hỗ trợ những ngôn ngữ nào?
Công cụ hỗ trợ chữ in ở 21 ngôn ngữ: tiếng Anh, tiếng Pháp, tiếng Đức, tiếng Tây Ban Nha, tiếng Bồ Đào Nha, tiếng Ý, tiếng Ba Lan, tiếng Thổ Nhĩ Kỳ, tiếng Indonesia, tiếng Việt, tiếng Trung (chữ giản thể và phồn thể), tiếng Nhật, tiếng Hàn, tiếng Nga, tiếng Ả Rập, tiếng Ba Tư, tiếng Urdu, tiếng Hindi, tiếng Bengali và tiếng Thái. Một trang có thể có hai thứ tiếng: chọn ngôn ngữ chính, thêm ngôn ngữ thứ hai cho trang lẫn, và tiếng Anh tự được đọc kèm tiếng Hàn, tiếng Nga, tiếng Ả Rập, tiếng Ba Tư, tiếng Urdu, tiếng Hindi, tiếng Bengali và tiếng Thái, vì gói của các tiếng này đứng một mình sẽ biến từ tiếng Anh thành chữ cái trông na ná. Chữ viết tay không được hỗ trợ ở bất kỳ ngôn ngữ nào.
Vì sao có chữ bị sai hoặc thiếu?
Kiểm tra gói ngôn ngữ trước tiên: lời cảnh báo dưới Markdown đưa ra “Nhận diện ngôn ngữ”, thử mỗi hệ chữ một gói OCR và giữ lại gói tốt nhất. Sau đó là ảnh: mờ, chói, bóng, nghiêng, chữ nhỏ, phông trang trí và nền rối đều làm giảm chất lượng, còn bảng hay trang nhiều cột có thể ra sai thứ tự. Chụp lại cho phẳng và nét, hoặc làm sạch trong máy quét trước, rồi kiểm tra Markdown trước khi dùng.