Бесплатный локальный OCR · 21 язык · страницы на двух языках · без загрузки
Конвертер картинки в Markdown (OCR)
Этот конвертер превращает картинку в Markdown — фото или скриншот с печатным текстом, — ничего никуда не загружая. Движок распознавания работает внутри браузера, знает 21 язык и читает страницы на двух языках: вы выбираете основной язык текста, при необходимости второй, а для языков, чьи пакеты сами не читают английский, автоматически подключается английский пакет. Картинка остаётся на устройстве, а после первой загрузки движка и нужных языковых пакетов конвертер работает и без сети.
Картинка → Markdown
Выберите картинку с печатным текстом
Выберите фото или скриншот, который браузер умеет читать, перетащите его сюда или вставьте через Ctrl+V / ⌘V. LensUp его не загружает.
Только печатный текст. На странице могут быть два языка: выберите основной, добавьте второй, а английский подключится к письменностям, которым он нужен. Таблицы с линиями становятся таблицами Markdown; рукописный текст, таблицы без линий, формулы и колонки распознаются приблизительно — проверяйте, прежде чем полагаться.
Pro один раз отправляет это фото целиком через сервер LensUp в Mathpix — коммерческий распознаватель формул и таблиц — и заменяет Markdown его результатом (формулы в виде $…$). LensUp не сохраняет фото; Mathpix обрабатывает его по своим условиям. Одно исправление — один запуск; 50 запусков стоят 4,99 $, разово, без подписки.
Как перевести картинку в Markdown?
Откройте конвертер изображения в Markdown, выберите фото или скриншот с печатным текстом, проверьте язык текста и нажмите «Распознать текст». LensUp выполняет OCR прямо на вашем устройстве — со вторым языком, если на странице два языка; для языков, чьи пакеты сами не читают английский, английский пакет подключается автоматически, — превращает абзацы, маркированные и нумерованные списки в блоки Markdown и даёт поправить результат, скопировать его или скачать файл .md. Картинка никогда не загружается на сервер.
Он предназначен для текста, который хочется сохранить как заметку, а не как картинку: страница книги или методички, слайд на проекторе, конспект с доски аккуратными печатными буквами, распечатанный рецепт, этикетка, бланк или абзац с афиши. Результат приходит в редактируемом Markdown — его можно сразу перенести в Obsidian, Notion, задачу GitHub или любой текстовый блокнот.
Границы нарочно узкие. Читается только печатный текст на выбранном языке плюс, по желанию, на втором; сохраняется структура, которую видно, — абзацы, маркированные и нумерованные списки, крупные заголовки и таблицы с линиями сетки, — а колонки, рукописный текст и математическая запись остаются приблизительным текстом, который стоит проверять построчно. Картинка в Markdown, изображение в MD, фото в Markdown, скриншот в Markdown, JPG в Markdown, распознавание текста с фото: называют по-разному, задача одна, и результат — всегда Markdown, который вы просматриваете, прежде чем на него положиться.
Как перевести картинку в Markdown
- Выберите картинкуВозьмите фото или скриншот с печатным текстом, перетащите его в инструмент или вставьте из буфера обмена через Ctrl+V / ⌘V. JPG, PNG, WebP, HEIC с iPhone и TIFF читаются локально; страница показывает картинку и её размер, ничего не отправляя.
- Проверьте язык и распознайтеВыберите язык печатного текста (меню подставляет язык этой страницы), добавьте второй, если на странице два языка, и нажмите «Распознать текст». В первый раз скачиваются движок OCR (около 1,5 МБ) и нужные языковые пакеты (по 0,4–3 МБ), дальше они берутся из кэша. Распознавание идёт на вашем устройстве, с индикатором хода.
- Проверьте, скопируйте или скачайтеMarkdown появляется в редактируемом поле рядом с фото — с числом слов или символов и средней уверенностью. Поправьте то, что движок прочитал неверно, и скопируйте текст в буфер обмена или скачайте файл .md.
Что становится Markdown, а что нет
Каждый печатный абзац становится абзацем Markdown: переносы строк склеиваются, слова, разорванные дефисом в конце строки, собираются обратно; строки на китайском, японском и тайском соединяются без пробелов и считаются в символах, а не в словах. Строки, начинающиеся с маркера, становятся списком; начинающиеся с 1., 2., 3. — или с 一、二、三 и 1、2、3 в восточноазиатских текстах — нумерованным списком; а короткая одиночная строка, напечатанная заметно крупнее основного текста или целиком заглавными, становится заголовком второго уровня. Всё остальное остаётся обычным текстом в порядке чтения.
Таблица с видимыми линиями сетки становится таблицей Markdown: сетка стирается перед распознаванием, каждая печатная строка становится строкой таблицы, а общие для строк промежутки задают столбцы; поэтому объединённые ячейки и таблицы без линий выходят обычными строками текста. Математические формулы не распознаются — дроби, показатели степени и символы рассыпаются; текст из двух колонок может перемешаться; рукописный текст, декоративные шрифты, очень мелкий текст и текст на пёстром фоне читаются плохо или пропускаются. Числа, имена и коды стоит перепроверить: одна неверная буква там весит больше, чем в абзаце. Средняя уверенность под результатом — оценка самого движка, а не гарантия.
Как снять страницу телефоном, чтобы она хорошо читалась
Распознавание лучше всего работает на ровной странице с резким, равномерно освещённым текстом, сфотографированной прямо, без наклона относительно камеры, с чёткостью примерно как у скана в 300 dpi. Заполните кадр текстом, избегайте теней и бликов и не двигайте телефон, пока не сработает фокус. Очень большие фото перед распознаванием уменьшаются до 2600 px по длинной стороне — обычный текст в книгах и документах остаётся полностью читаемым, а памяти и времени уходит меньше.
Если страница перекошена или в тени, сначала прогоните её через сканер LensUp: исправление перспективы и удаление теней дают ровную контрастную страницу, и скачанный из сканера JPG или PNG — отличный исходник здесь. Скриншоты распознаватель тоже принимает — обычно это самый простой случай.
Когда локального движка мало: исправить через Pro
Tesseract — открытый движок, который используется в бесплатном режиме, — не читает математическую запись и плохо справляется с таблицами без линий и с объединёнными ячейками. Для таких страниц поле результата может предложить «Исправить через Pro» — платную возможность, которая появляется, когда на сайте включены платежи: фотография целиком один раз отправляется через сервер LensUp в сервис Mathpix — коммерческий распознаватель, созданный для формул и таблиц, — и его Markdown заменяет локальный результат: формулы как LaTeX между знаками доллара, таблицы как таблицы Markdown. LensUp при передаче ничего не сохраняет (Mathpix обрабатывает фото по своим условиям); локальный результат остаётся в одном клике.
Pro оплачивается за каждый запуск именно для того, чтобы бесплатный режим оставался бесплатным и локальным: пока он доступен, вы входите по ссылке из письма (без пароля), покупаете 50 запусков разовым платежом в 4,99 $ (без подписки), и на каждое исправление через Pro расходуется один запуск. Если сбой произошёл на стороне поставщика, запуск не списывается.
Смешанные языки обрабатываются локально — так и задумано
Страница предлагает 21 язык: английский, французский, немецкий, испанский, португальский, итальянский, польский, турецкий, индонезийский, вьетнамский, китайский (упрощённый и традиционный), японский, корейский, русский, арабский, персидский, урду, хинди, бенгальский и тайский — те же, на которых говорит сам LensUp. Каждый язык — отдельный пакет, который скачивается, только когда вы его выбираете: для французского нужен пакет на 0,7 МБ, для китайского — около 1,7 МБ; весь набор не скачивается. Выбирайте язык, который действительно напечатан, и добавляйте второй, если на странице два языка; к корейскому, русскому, арабскому, персидскому, урду, хинди, бенгальскому и тайскому английский подгружается сам, иначе эти пакеты превращают английские слова в похожие буквы. С неверным пакетом вместо Markdown выходят обрывки, строка состояния об этом сообщает, а «Определить язык» находит нужный пакет, пробуя по одному на каждую письменность, — так и страница на двух языках становится чистым Markdown.
Всё работает локально на открытом движке — так же, как LensUp обрабатывает остальные изображения: без загрузки, без аккаунта, без копии вашего фото или текста на сервере. Файлы движка и пакеты отдаются с lensup.ai и кэшируются браузером, поэтому второе распознавание на том же языке начинается мгновенно. Инструменты сканера по-прежнему не содержат OCR и не делают PDF с поиском по тексту.
Частые вопросы
Уходит ли картинка с моего устройства, когда я перевожу её в Markdown?
На бесплатном режиме — нет: движок OCR и выбранный языковой пакет скачиваются в браузер, распознавание идёт там, и ни фото, ни распознанный текст, ни файл .md не попадают на сервер LensUp. Единственное исключение — явное и по вашему выбору: когда поле результата предлагает «Исправить через Pro» (платная возможность, которая появляется при включённых платежах), при нажатии всё фото отправляется через LensUp в Mathpix (коммерческий распознаватель формул и таблиц), после чего возвращается его Markdown; LensUp при передаче ничего не сохраняет (Mathpix обрабатывает фото по своим условиям), нужны вход по e-mail и оплаченные запуски (50 запусков за 4,99 $, разово), а локальный результат можно вернуть.
Какие языки поддерживает конвертер картинки в Markdown?
Двадцать один печатный язык: английский, французский, немецкий, испанский, португальский, итальянский, польский, турецкий, индонезийский, вьетнамский, китайский (упрощённый и традиционный), японский, корейский, русский, арабский, персидский, урду, хинди, бенгальский и тайский. На странице могут быть два из них: выберите основной, добавьте второй для страницы на двух языках, а английский читается автоматически вместе с корейским, русским, арабским, персидским, урду, хинди, бенгальским и тайским, потому что эти пакеты сами по себе превращают английские слова в похожие буквы. Рукописный текст не поддерживается ни на одном языке.
Почему часть текста распознана неверно или пропала?
Сначала проверьте языковой пакет: предупреждение под Markdown предлагает «Определить язык» — он пробует по одному пакету OCR на каждую письменность и оставляет лучший. Потом само фото: размытость, блики, тени, перекос, мелкий шрифт, декоративные шрифты и пёстрый фон снижают качество, а таблицы и многоколоночные страницы могут выйти не в том порядке. Держите страницу ровно и сделайте чёткий снимок или сначала обработайте её в сканере, а Markdown проверьте перед использованием.