OCR lokal gratis · 21 bahasa · halaman campuran · tanpa unggah
Ubah Gambar ke Markdown (OCR)
Konverter gambar ke Markdown ini mengubah foto atau tangkapan layar berisi teks cetak menjadi Markdown tanpa mengunggah gambar ke mana pun. Mesin OCR berjalan di browser Anda, mendukung pengenalan teks dalam 21 bahasa, dan dapat membaca halaman multibahasa: Anda memilih bahasa utama teks, bahasa kedua bila perlu, dan paket bahasa Inggris dimuat otomatis untuk aksara yang paket bahasa tersebut tidak dapat membaca kata-kata bahasa Inggris jika digunakan sendiri. Gambar tetap di perangkat Anda, dan setelah mesin serta paket bahasa yang dipakai terunduh sekali, konverter tetap bekerja tanpa koneksi.
Gambar → Markdown
Pilih satu gambar berisi teks cetak
Pilih foto atau tangkapan layar yang bisa dibaca browser, seret dan lepaskan di sini, atau tempel dengan Ctrl+V / ⌘V. LensUp tidak mengunggahnya.
Hanya teks cetak. Satu halaman boleh dua bahasa: pilih bahasa utama, tambahkan bahasa kedua, dan bahasa Inggris ditambahkan untuk aksara yang memerlukannya. Tabel bergaris menjadi tabel Markdown; tulisan tangan, tabel tanpa garis, rumus, dan tata letak multikolom mungkin tidak dikenali dengan akurat — periksa sebelum diandalkan.
Pro mengirim seluruh foto ini, sekali saja, lewat server LensUp ke Mathpix — pengenal komersial yang membaca rumus dan tabel — dan mengganti Markdown dengan hasilnya (rumus sebagai $…$). LensUp tidak menyimpan foto; Mathpix memprosesnya sesuai ketentuannya sendiri. Setiap perbaikan memakai 1 kredit; 50 kredit seharga US$4,99, sekali bayar, tanpa langganan.
Bagaimana cara mengubah gambar ke Markdown?
Buka konverter gambar ke Markdown, pilih foto atau tangkapan layar berisi teks cetak, periksa bahasa teksnya, lalu tekan “Kenali teks”. LensUp menjalankan OCR di perangkat Anda sendiri — dengan bahasa kedua bila halamannya campuran, dan dengan paket bahasa Inggris untuk aksara yang memerlukannya — lalu mengubah paragraf, poin, dan daftar bernomor menjadi blok Markdown. Hasilnya bisa Anda perbaiki, salin, atau unduh sebagai .md. Gambar tidak pernah diunggah.
Alat ini dibuat untuk teks yang ingin Anda simpan sebagai catatan, bukan sebagai gambar: halaman buku atau diktat, slide di proyektor, ringkasan papan tulis dengan huruf kapital yang rapi, resep cetak, label produk, formulir, atau paragraf di poster. Hasil pengenalan tersedia sebagai Markdown yang bisa disunting, siap untuk Obsidian, Notion, issue GitHub, atau buku catatan teks biasa apa pun.
Cakupannya sengaja dibuat sempit. Alat ini hanya membaca teks cetak dalam bahasa utama yang Anda pilih, dengan satu bahasa kedua sebagai pilihan; ia menjaga struktur yang terlihat — paragraf, daftar berpoin, daftar bernomor, judul besar, dan tabel bergaris — sementara tata letak multikolom, tulisan tangan, dan notasi matematika mungkin tidak dikenali dengan akurat, jadi periksa baris demi baris. Gambar ke Markdown, gambar ke MD, foto ke Markdown, tangkapan layar ke Markdown, JPG ke Markdown, OCR foto ke teks: namanya berbeda, pekerjaannya sama, dan hasilnya selalu Markdown yang Anda periksa dulu sebelum diandalkan.
Cara mengubah gambar ke Markdown
- Pilih satu gambarPilih foto atau tangkapan layar berisi teks cetak, seret ke alat ini, atau tempel dari papan klip dengan Ctrl+V / ⌘V. JPG, PNG, WebP, HEIC iPhone, dan TIFF dibaca secara lokal; halaman menampilkan gambar dan ukurannya tanpa mengunggah apa pun.
- Periksa bahasa lalu kenaliPilih bahasa teks cetaknya (menu sudah memilih bahasa halaman ini), tambahkan bahasa kedua bila halamannya campuran, lalu tekan “Kenali teks”. Pada pemakaian pertama, mesin OCR (sekitar 1,5 MB) dan paket bahasa yang diperlukan (0,4–3 MB per paket) diunduh, lalu disimpan di cache. Pembacaan berlangsung di perangkat Anda dengan bilah kemajuan.
- Periksa, salin, atau unduhMarkdown muncul di kotak yang bisa disunting di samping foto, lengkap dengan jumlah kata atau karakter dan tingkat keyakinan rata-rata. Perbaiki bagian yang salah dibaca mesin, lalu salin ke papan klip atau unduh sebagai file .md.
Apa yang menjadi Markdown, dan apa yang tidak
Setiap paragraf cetak menjadi satu paragraf Markdown: pemisah baris digabung dan kata yang terpotong tanda hubung di ujung baris disambung kembali; baris teks Tionghoa, Jepang, dan Thai digabung tanpa spasi dan dihitung per karakter, bukan per kata. Baris yang diawali tanda poin menjadi daftar; baris yang diawali 1., 2., 3. — atau 一、二、三 dan 1、2、3 pada teks Asia Timur — menjadi daftar bernomor; dan satu baris pendek yang dicetak jelas lebih besar dari teks utama atau seluruhnya kapital menjadi judul tingkat dua. Sisanya tetap teks biasa sesuai urutan baca.
Tabel yang digambar dengan garis menjadi tabel Markdown: kisi dihapus sebelum pengenalan, setiap baris cetak menjadi baris tabel, dan celah yang sama di semua baris menjadi kolom; karena itu sel gabungan dan tabel tanpa garis keluar sebagai baris teks biasa. Rumus matematika tidak dikenali — pecahan, pangkat, dan simbol menjadi kacau; urutan teks pada tata letak dua kolom dapat tercampur; tulisan tangan, font dekoratif, huruf sangat kecil, dan teks di atas latar ramai terbaca buruk atau terlewat. Angka, nama, dan kode layak diperiksa ulang: satu karakter yang salah pada data tersebut bisa berdampak lebih besar daripada kesalahan dalam paragraf biasa. Keyakinan rata-rata di bawah hasil adalah perkiraan mesin sendiri, bukan jaminan.
Agar foto dari ponsel terbaca bersih
Pengenalan karakter bekerja paling baik pada halaman yang rata, teks yang tajam, pencahayaan merata, dan foto yang diambil lurus dari depan, dengan ketajaman kira-kira setara pindaian 300 dpi. Penuhi bingkai dengan teks, hindari bayangan dan silau, dan tahan ponsel sampai fokus terkunci. Foto yang sangat besar diperkecil ke 2600 px pada sisi terpanjang sebelum dikenali; teks pada buku dan dokumen biasa tetap dapat dibaca dengan jelas, sementara memori dan waktu dihemat.
Jika halaman miring atau berbayang, proses dulu dengan pemindai LensUp: koreksi perspektif dan penghilangan bayangan menghasilkan halaman yang rata dan berkontras tinggi, dan JPG atau PNG yang diunduh dari pemindai cocok digunakan sebagai masukan untuk alat ini. Mesin OCR juga dapat membaca tangkapan layar, yang biasanya kasus paling mudah.
Saat mesin lokal tidak cukup: perbaiki dengan Pro
Tesseract, mesin sumber terbuka yang digunakan pada versi gratis, tidak membaca notasi matematika dan kesulitan dengan tabel tanpa garis atau sel gabungan. Untuk halaman seperti itu, kotak hasil bisa menawarkan “Perbaiki dengan Pro” — opsi berbayar yang muncul begitu pembayaran diaktifkan di situs: seluruh foto dikirim sekali, lewat server LensUp, ke Mathpix — pengenal komersial yang dibuat untuk rumus dan tabel — dan Markdown darinya menggantikan hasil lokal, dengan rumus sebagai LaTeX di antara tanda dolar dan tabel sebagai tabel Markdown. LensUp tidak menyimpan foto selama pengiriman (Mathpix memprosesnya sesuai ketentuannya sendiri); hasil lokal bisa dipulihkan dengan satu klik.
Pro dikenakan biaya per penggunaan agar versi gratis tetap gratis dan diproses secara lokal: selama fitur ini tersedia, Anda dapat masuk melalui tautan email (tanpa kata sandi), membeli paket 50 kredit seharga US$4,99 dengan pembayaran satu kali tanpa langganan, dan setiap perbaikan dengan Pro memakai satu kredit. Jika penyedia gagal memprosesnya, kredit tidak dipotong.
Halaman multibahasa diproses langsung di perangkat
Halaman ini menawarkan 21 bahasa: Inggris, Prancis, Jerman, Spanyol, Portugis, Italia, Polandia, Turki, Indonesia, Vietnam, Tionghoa (aksara sederhana dan tradisional), Jepang, Korea, Rusia, Arab, Persia, Urdu, Hindi, Bengali, dan Thai — semuanya merupakan bahasa yang didukung LensUp. Setiap bahasa adalah paket terpisah yang hanya diunduh saat Anda memilihnya: halaman Prancis butuh paket 0,7 MB, halaman berbahasa Tionghoa membutuhkan paket sekitar 1,7 MB; seluruh paket bahasa tidak pernah diunduh sekaligus. Pilih bahasa yang benar-benar tercetak dan tambahkan bahasa kedua bila halamannya campuran; bahasa Inggris dimuat otomatis bersama Korea, Rusia, Arab, Persia, Urdu, Hindi, Bengali, dan Thai, karena paket-paket itu sendirian mengubah kata Inggris menjadi huruf yang mirip. Jika paket yang dipilih salah, hasilnya berupa potongan teks, bukan Markdown yang utuh; baris status akan memberi tahu Anda, dan “Deteksi bahasa” menemukan paket yang benar dengan mencoba satu paket per sistem tulisan — jadi halaman campuran pun tetap menjadi Markdown yang bersih.
Semuanya berjalan lokal dengan mesin sumber terbuka, sama seperti LensUp memproses gambar lainnya: tanpa unggah, tanpa akun, tanpa salinan foto atau teks Anda di server mana pun. File mesin dan paket disajikan dari lensup.ai dan disimpan di cache browser, sehingga pengenalan kedua dalam bahasa yang sama langsung dimulai. Alat pemindai sendiri tetap tidak berisi OCR dan tidak membuat PDF yang bisa dicari.
Pertanyaan yang sering diajukan
Apakah gambar keluar dari perangkat saya saat mengubah gambar ke Markdown?
Pada versi gratis, tidak: mesin OCR dan paket bahasa yang Anda pilih diunduh ke browser dan pengenalan berlangsung di situ, sehingga foto, teks yang dikenali, maupun file .md tidak pernah sampai ke server LensUp. Satu-satunya pengecualian bersifat eksplisit dan atas pilihan Anda: ketika kotak hasil menawarkan “Perbaiki dengan Pro” (opsi berbayar yang muncul saat pembayaran aktif), klik itu mengirim seluruh foto lewat LensUp ke Mathpix (pengenal komersial untuk rumus dan tabel) dan membawa kembali Markdown-nya; LensUp tidak menyimpan foto selama pengiriman (Mathpix memprosesnya sesuai ketentuannya sendiri), perlu masuk dengan email dan kredit berbayar (50 kredit seharga US$4,99, sekali bayar), dan hasil lokal bisa dipulihkan.
Bahasa apa saja yang didukung konverter gambar ke Markdown?
Dua puluh satu bahasa cetak: Inggris, Prancis, Jerman, Spanyol, Portugis, Italia, Polandia, Turki, Indonesia, Vietnam, Tionghoa (aksara sederhana dan tradisional), Jepang, Korea, Rusia, Arab, Persia, Urdu, Hindi, Bengali, dan Thai. Satu halaman boleh memuat dua di antaranya: pilih bahasa utama, tambahkan bahasa kedua untuk halaman campuran, dan bahasa Inggris dibaca otomatis bersama Korea, Rusia, Arab, Persia, Urdu, Hindi, Bengali, dan Thai, karena paket-paket itu sendirian mengubah kata Inggris menjadi huruf yang mirip. Tulisan tangan tidak didukung dalam bahasa apa pun.
Mengapa ada teks yang salah atau hilang?
Yang pertama diperiksa adalah paket bahasanya: peringatan di bawah Markdown menawarkan “Deteksi bahasa”, yang mencoba satu paket OCR per sistem tulisan dan menyimpan yang terbaik. Setelah itu fotonya: buram, silau, bayangan, kemiringan, huruf kecil, font dekoratif, dan latar ramai semuanya menurunkan kualitas, dan tabel atau halaman berkolom bisa keluar dengan urutan yang salah. Foto ulang dengan rata dan tajam, atau bersihkan dulu di pemindai, lalu periksa Markdown-nya sebelum dipakai.