무료 기기 내 OCR · 21개 언어 · 혼합 페이지 · 업로드 없음
이미지 마크다운 변환 (OCR)
이 이미지 마크다운 변환 도구는 이미지를 어디에도 보내지 않은 채, 인쇄된 글자가 담긴 사진이나 스크린샷을 마크다운으로 바꿉니다. OCR 엔진은 브라우저 안에서 돌아가며 21개 언어를 읽고, 언어가 섞인 페이지도 처리합니다. 본문의 주 언어를 고르고 필요하면 두 번째 언어를 더하세요. 한국어·러시아어처럼 해당 언어 팩만으로 영어 단어를 제대로 읽을 수 없는 경우에는 영어 팩도 자동으로 로드됩니다. 이미지는 기기에 남고, 엔진과 언어 팩을 한 번 내려받으면 오프라인에서도 계속 쓸 수 있습니다.
이미지 → 마크다운
인쇄된 글자가 있는 이미지를 고르세요
브라우저가 읽을 수 있는 사진이나 스크린샷을 고르거나, 여기에 놓거나, Ctrl+V / ⌘V로 붙여 넣으세요. LensUp은 업로드하지 않습니다.
인쇄된 글자만 읽습니다. 한 페이지에 두 언어까지: 주 언어를 고르고 두 번째를 더하면, 영어가 필요한 문자 체계에는 영어가 붙습니다. 괘선이 있는 표는 마크다운 표가 됩니다. 손글씨, 선 없는 표, 수식, 단 나누기는 정확히 인식되지 않을 수 있습니다—쓰기 전에 확인하세요.
Pro는 이 사진 전체를 LensUp 서버를 거쳐 딱 한 번 Mathpix—수식과 표를 읽는 상용 인식 엔진—로 보내고 그 결과로 마크다운을 바꿉니다(수식은 $…$ 형태). LensUp은 사진을 저장하지 않으며, Mathpix는 자체 약관에 따라 처리합니다. 수정 한 번에 1크레딧이 쓰입니다. 50크레딧은 4.99달러이며, 일회성 결제이고 구독 상품이 아닙니다.
이미지 마크다운 변환은 어떻게 하나요?
이미지 마크다운 변환 도구를 열고, 인쇄된 글자가 찍힌 사진이나 스크린샷을 고른 뒤 글자의 언어를 확인하고 ‘글자 인식’을 누르세요. LensUp은 OCR을 사용자의 기기 안에서 실행합니다. 두 언어가 섞인 페이지면 두 번째 언어를 더할 수 있고, 영어 단어를 따로 읽지 못하는 언어 팩에는 영어 팩도 자동으로 함께 로드됩니다. 문단, 글머리 기호, 번호 목록은 마크다운 블록으로 정리되며, 결과는 그 자리에서 수정하고 복사하거나 .md로 내려받을 수 있습니다. 이미지는 절대 업로드되지 않습니다.
이미지가 아니라 메모로 남기고 싶은 글을 위한 도구입니다. 책이나 유인물의 한 페이지, 프로젝터에 띄운 슬라이드, 또박또박 쓴 칠판 요약, 인쇄된 조리법, 제품 라벨, 서식, 포스터의 한 문단 같은 것들이죠. 인식된 글은 편집 가능한 마크다운으로 나와 Obsidian, Notion, GitHub 이슈, 어떤 일반 텍스트 노트에도 바로 붙일 수 있습니다.
범위는 일부러 좁게 잡았습니다. 인쇄된 글자만, 선택한 주 언어를 읽고, 필요하면 두 번째 언어까지 추가할 수 있습니다. 눈에 보이는 구조—문단, 글머리 기호 목록, 번호 목록, 큰 제목, 괘선이 있는 표—는 마크다운으로 유지하고, 단 나누기·손글씨·수식은 정확히 인식되지 않을 수 있으므로 줄마다 확인해야 합니다. 이미지 마크다운 변환, 이미지를 MD로, 사진을 마크다운으로, 스크린샷을 마크다운으로, JPG를 마크다운으로, 사진 OCR 텍스트 추출—이름은 달라도 하는 일은 같고, 결과는 언제나 쓰기 전에 직접 확인하는 마크다운입니다.
이미지 마크다운 변환 방법
- 이미지 한 장 고르기인쇄된 글자가 찍힌 사진이나 스크린샷을 고르고, 도구 위에 끌어다 놓거나 Ctrl+V / ⌘V로 클립보드에서 붙여 넣으세요. JPG, PNG, WebP, 아이폰의 HEIC, TIFF 모두 기기 안에서 읽히고, 페이지는 이미지와 크기를 보여 줄 뿐 아무것도 보내지 않습니다.
- 언어 확인 후 인식하기인쇄된 글자의 언어를 고르고(메뉴는 이 페이지의 언어를 먼저 골라 둡니다) 혼합 페이지라면 두 번째 언어를 더한 뒤 ‘글자 인식’을 누르세요. 처음 한 번은 OCR 엔진(약 1.5 MB)과 필요한 언어 팩(각 0.4~3 MB)을 내려받고, 이후에는 캐시를 씁니다. 인식은 진행 막대와 함께 기기 안에서 이루어집니다.
- 확인하고 복사하거나 내려받기마크다운은 사진 옆의 편집 칸에 나타나고, 단어 또는 글자 수와 평균 신뢰도가 함께 표시됩니다. 엔진이 잘못 읽은 곳을 고친 다음 클립보드에 복사하거나 .md 파일로 내려받으세요.
마크다운이 되는 것과 되지 않는 것
인쇄된 문단 하나는 마크다운 문단 하나가 됩니다. 줄바꿈은 이어 붙이고 줄 끝 하이픈으로 끊긴 단어는 되살립니다. 중국어·일본어·태국어 줄은 띄어쓰기 없이 이어 붙이고 단어 대신 글자 수로 셉니다. 글머리 기호로 시작하는 줄은 목록이 되고, 1., 2., 3.—동아시아 문서라면 一、二、三이나 1、2、3—으로 시작하는 줄은 번호 목록이 되며, 본문보다 눈에 띄게 크거나 전부 대문자인 짧은 한 줄은 2단계 제목이 됩니다. 나머지는 읽는 순서대로 일반 텍스트로 남습니다.
괘선으로 그린 표는 마크다운 표가 됩니다. 인식 전에 격자를 지우고, 인쇄된 각 줄을 표의 행으로, 행들이 공유하는 빈 자리를 열로 삼기 때문에, 병합된 셀과 선이 전혀 없는 표는 일반 텍스트 줄로 나옵니다. 수식은 인식되지 않습니다—분수, 지수, 기호가 뒤섞입니다. 2단 레이아웃에서는 줄 순서가 뒤섞일 수 있고, 손글씨·장식 글꼴·아주 작은 글자·무늬가 짙은 배경 위의 글자는 잘 읽히지 않거나 건너뜁니다. 숫자, 이름, 코드는 한 글자만 틀려도 본문 오타보다 영향이 클 수 있으므로 한 번 더 살펴보세요. 결과 아래의 평균 신뢰도는 엔진 자신의 추정치이지 보증이 아닙니다.
휴대폰 사진을 더 정확히 인식시키려면
글자 인식은 평평하고 선명하고 고르게 밝은 글자를 정면에서 찍었을 때, 300 dpi 스캔 정도의 선명도에서 가장 잘 됩니다. 화면을 글자로 채우고, 그림자와 반사를 피하고, 초점이 맞을 때까지 가만히 두세요. 아주 큰 사진은 인식 전에 긴 변이 2600px가 되도록 줄이는데, 책과 문서의 보통 글자는 그대로 충분히 읽히면서 메모리와 시간을 아낍니다.
페이지가 기울었거나 그림자가 졌다면 먼저 LensUp 스캐너를 거치세요. 원근 보정과 그림자 제거로 평평하고 대비가 높은 페이지가 나오고, 스캐너에서 내려받은 JPG나 PNG는 이 도구에서 인식하기에 적합합니다. 스크린샷도 그대로 읽힙니다—대개 가장 쉬운 경우입니다.
기기 내 엔진으로 부족할 때: Pro로 수정
무료 기능에 쓰이는 오픈소스 엔진 Tesseract는 수식을 읽지 못하고, 선 없는 표나 병합된 셀도 힘들어합니다. 그런 페이지를 위해 결과 칸에 ‘Pro로 수정’이 나타날 수 있습니다. 사이트에서 결제가 열리면 보이는 유료 옵션으로, 사진 전체를 LensUp 서버를 거쳐 딱 한 번 Mathpix—수식과 표를 위해 만들어진 상용 인식 엔진—로 보내고, 돌아온 마크다운으로 기기 내 결과를 바꿉니다. 수식은 달러 기호 사이의 LaTeX로, 표는 마크다운 표로 나옵니다. LensUp은 전송 과정에서 사진을 저장하지 않으며(Mathpix는 자체 약관에 따라 처리), 기기 내 결과는 클릭 한 번이면 돌아옵니다.
무료 기능을 계속 무료·로컬 방식으로 제공하기 위해 Pro는 건당 요금을 받습니다. 제공되는 동안에는 이메일 링크로 로그인하고(비밀번호 없음), 50크레딧을 4.99달러에 일회성으로 구매하며(구독료 없음), Pro 수정 한 번에 1크레딧이 쓰입니다. 공급자 쪽에서 실패하면 크레딧은 차감되지 않습니다.
여러 언어가 섞인 페이지도 기기에서 처리
이 페이지는 21개 언어를 제공합니다. 영어, 프랑스어, 독일어, 스페인어, 포르투갈어, 이탈리아어, 폴란드어, 터키어, 인도네시아어, 베트남어, 중국어(간체·번체), 일본어, 한국어, 러시아어, 아랍어, 페르시아어, 우르두어, 힌디어, 벵골어, 태국어—LensUp 자체가 쓰는 언어들입니다. 언어마다 별도의 팩이라 고를 때만 내려받습니다. 프랑스어 페이지는 0.7 MB 팩 하나, 중국어 페이지는 약 1.7 MB이며 전체를 한꺼번에 받는 일은 없습니다. 실제로 인쇄된 언어를 고르고 혼합 페이지면 두 번째를 더하세요. 한국어, 러시아어, 아랍어, 페르시아어, 우르두어, 힌디어, 벵골어, 태국어에는 영어 팩이 자동으로 함께 로드됩니다. 이 팩들만으로는 영어 단어가 비슷하게 생긴 글자로 바뀌기 때문입니다. 잘못된 팩으로 읽으면 마크다운 대신 조각이 나오지만 상태 줄이 알려 주고, ‘언어 감지’가 문자 체계마다 팩을 하나씩 시험해 맞는 것을 찾습니다—그래서 섞인 페이지도 깔끔한 마크다운이 됩니다.
모든 것은 오픈소스 엔진으로 기기 안에서 끝납니다. LensUp이 다른 이미지를 다루는 방식과 같습니다. 업로드 없음, 계정 없음, 서버에 사진이나 글의 사본 없음. 엔진 파일과 팩은 lensup.ai에서 내려받아 브라우저가 캐시하므로 같은 언어의 두 번째 인식은 바로 시작됩니다. 스캐너 도구에는 여전히 OCR이 없고 검색 가능한 PDF도 만들지 않습니다.
자주 묻는 질문
이미지를 마크다운으로 변환할 때 이미지가 기기 밖으로 나가나요?
무료 경로에서는 나가지 않습니다. OCR 엔진과 고른 언어 팩이 브라우저로 내려오고 인식은 거기서 이루어지므로, 사진도 인식된 글도 .md 파일도 LensUp 서버에 닿지 않습니다. 유일한 예외는 명시적이고 직접 선택하는 것입니다. 결과 칸에 ‘Pro로 수정’(결제가 열리면 나타나는 유료 옵션)이 보일 때 그것을 누르면 사진 전체가 LensUp을 거쳐 Mathpix(수식과 표를 위한 상용 인식 엔진)로 가고 마크다운이 돌아옵니다. LensUp은 전송 과정에서 사진을 저장하지 않으며(Mathpix는 자체 약관에 따라 처리), 이메일 로그인과 유료 크레딧(50크레딧 4.99달러, 일회성 결제)이 필요하고, 기기 내 결과는 되돌릴 수 있습니다.
이미지 마크다운 변환은 어떤 언어를 지원하나요?
인쇄 글자 기준 21개 언어입니다. 영어, 프랑스어, 독일어, 스페인어, 포르투갈어, 이탈리아어, 폴란드어, 터키어, 인도네시아어, 베트남어, 중국어(간체·번체), 일본어, 한국어, 러시아어, 아랍어, 페르시아어, 우르두어, 힌디어, 벵골어, 태국어. 한 페이지에 두 언어까지: 주 언어를 고르고 혼합 페이지면 두 번째를 더하세요. 한국어, 러시아어, 아랍어, 페르시아어, 우르두어, 힌디어, 벵골어, 태국어는 영어가 자동으로 함께 읽힙니다. 이 팩들만으로는 영어 단어가 비슷한 글자로 바뀌기 때문입니다. 손글씨는 어떤 언어에서도 지원하지 않습니다.
글자가 틀리거나 빠지는 이유는?
먼저 언어 팩이 맞는지 확인하세요. 마크다운 아래 안내의 ‘언어 감지’는 문자 체계마다 OCR 팩을 하나씩 시험해 가장 좋은 것을 남깁니다. 그다음은 사진입니다. 흐림, 반사, 그림자, 기울기, 작은 글자, 장식 글꼴, 복잡한 배경은 모두 정확도를 떨어뜨리고, 표나 여러 단으로 된 페이지는 순서가 뒤바뀔 수 있습니다. 평평하고 선명하게 다시 찍거나 먼저 스캐너로 정리한 뒤, 쓰기 전에 마크다운을 확인하세요.