Kostenlose lokale OCR · 21 Sprachen · gemischte Seiten · kein Upload
Bild in Markdown umwandeln (OCR)
Dieser Konverter wandelt ein Bild in Markdown um – ein Foto oder einen Screenshot mit gedrucktem Text – ohne das Bild irgendwohin hochzuladen. Die OCR-Engine läuft in Ihrem Browser, beherrscht 21 Sprachen und liest gemischte Seiten: Sie wählen die Hauptsprache des Textes, bei Bedarf eine zweite, und bei Schriften, deren Sprachpakete Englisch nicht selbst lesen können, wird das Englisch-Paket automatisch mitgeladen. Das Bild bleibt auf Ihrem Gerät, und sobald Engine und Sprachpakete einmal geladen sind, arbeitet der Konverter auch offline.
Bild → Markdown
Wählen Sie ein Bild mit gedrucktem Text
Wählen Sie ein Foto oder einen Screenshot, den der Browser lesen kann, legen Sie es hier ab oder fügen Sie es mit Strg+V / ⌘V ein. LensUp lädt es nicht hoch.
Nur gedruckter Text. Eine Seite kann zwei Sprachen enthalten: Hauptsprache wählen, eine zweite hinzufügen, und Englisch wird für Schriften ergänzt, die es brauchen. Tabellen mit Linien werden zu Markdown-Tabellen; Handschrift, Tabellen ohne Linien, Formeln und Spalten sind nur Näherungen – prüfen Sie, bevor Sie sich darauf verlassen.
Pro sendet dieses ganze Foto einmal über den LensUp-Server an Mathpix – einen kommerziellen Erkennungsdienst für Formeln und Tabellen – und ersetzt den Markdown-Text durch dessen Ergebnis (Formeln als $…$). LensUp speichert das Foto nicht; Mathpix verarbeitet es nach seinen eigenen Bedingungen. Eine Nachbesserung verbraucht eine Nutzung; 50 Nutzungen kosten einmalig 4,99 USD, ohne Abo.
Wie wandle ich ein Bild in Markdown um?
Öffnen Sie den Bild-zu-Markdown-Konverter, wählen Sie ein Foto oder einen Screenshot mit gedrucktem Text, prüfen Sie die Sprache des Textes und klicken Sie auf „Text erkennen“. LensUp führt die Texterkennung auf Ihrem Gerät aus: Bei gemischten Seiten liest es eine zweite Sprache mit, und für Schriften, deren Pakete Englisch nicht selbst lesen, wird das Englisch-Paket mitgeladen. Es macht aus Absätzen, Aufzählungen und nummerierten Listen Markdown-Blöcke und lässt Sie das Ergebnis korrigieren, kopieren oder als .md herunterladen. Das Bild wird nie hochgeladen.
Gedacht ist er für Text, den Sie als Notiz behalten wollen und nicht als Bild: eine Buch- oder Skriptseite, eine projizierte Folie, eine sauber in Großbuchstaben geschriebene Whiteboard-Zusammenfassung, ein gedrucktes Rezept, ein Produktetikett, ein Formular oder ein Absatz auf einem Plakat. Der erkannte Text kommt als bearbeitbares Markdown – bereit für Obsidian, Notion, ein GitHub-Issue oder jedes Notizbuch im Klartext.
Der Funktionsumfang ist bewusst begrenzt. Erkannt wird nur gedruckter Text in der gewählten Sprache plus einer optionalen zweiten; erhalten bleibt die Struktur, die zu sehen ist – Absätze, Aufzählungen, nummerierte Listen, größere Überschriften und Tabellen mit Linien –, während Spalten, Handschrift und mathematische Notation nur näherungsweise als Text erscheinen und Zeile für Zeile geprüft werden sollten. Bild in Markdown umwandeln, Bild zu MD, Foto zu Markdown, Screenshot zu Markdown, JPG zu Markdown, Foto-OCR zu Text: Die Bezeichnung wechselt, die Aufgabe ist dieselbe, und das Ergebnis ist immer ein Markdown-Text, den Sie prüfen, bevor Sie sich darauf verlassen.
So wandeln Sie ein Bild in Markdown um
- Ein Bild auswählenWählen Sie ein Foto oder einen Screenshot mit gedrucktem Text, ziehen Sie es auf das Werkzeug oder fügen Sie es mit Strg+V / ⌘V aus der Zwischenablage ein. JPG, PNG, WebP, HEIC vom iPhone und TIFF werden lokal gelesen; die Seite zeigt Bild und Größe an, ohne etwas hochzuladen.
- Sprache prüfen und erkennen lassenWählen Sie die Sprache des gedruckten Textes (das Menü schlägt die Sprache dieser Seite vor), fügen Sie bei gemischten Seiten eine zweite Sprache hinzu und klicken Sie auf „Text erkennen“. Beim ersten Durchlauf werden die OCR-Engine (etwa 1,5 MB) und die benötigten Sprachpakete (je 0,4–3 MB) geladen und danach zwischengespeichert. Die Erkennung läuft auf Ihrem Gerät, mit Fortschrittsbalken.
- Prüfen, kopieren oder herunterladenDas Markdown erscheint in einem bearbeitbaren Feld neben dem Foto, mit Wort- oder Zeichenzahl und mittlerer Erkennungssicherheit. Korrigieren Sie, was die Engine falsch gelesen hat, und kopieren Sie den Text in die Zwischenablage oder laden Sie eine .md-Datei herunter.
Was zu Markdown wird – und was nicht
Jeder gedruckte Absatz wird zu einem Markdown-Absatz: Zeilenumbrüche werden zusammengefügt und am Zeilenende getrennte Wörter wieder verbunden; chinesische, japanische und thailändische Zeilen werden ohne Leerzeichen aneinandergehängt und in Zeichen statt in Wörtern gezählt. Zeilen, die mit einem Aufzählungszeichen beginnen, werden zur Liste; Zeilen, die mit 1., 2., 3. beginnen – oder mit 一、二、三 und 1、2、3 in ostasiatischen Texten –, zur nummerierten Liste; und eine kurze, allein stehende Zeile, die deutlich größer als der Fließtext oder komplett in Großbuchstaben gedruckt ist, wird zur Überschrift zweiter Ebene. Alles andere bleibt Klartext in Lesereihenfolge.
Eine mit Linien gezeichnete Tabelle wird zur Markdown-Tabelle: Das Raster wird vor der Erkennung entfernt, jede gedruckte Zeile wird zur Tabellenzeile, und die Lücken, die alle Zeilen teilen, ergeben die Spalten; verbundene Zellen und Tabellen ganz ohne Linien kommen deshalb als Textzeilen heraus. Mathematische Formeln werden nicht erkannt – Brüche, Exponenten und Symbole geraten durcheinander; zweispaltige Layouts können sich verzahnen; Handschrift, Zierschriften, sehr kleine Schrift und Text auf unruhigem Hintergrund werden schlecht gelesen oder übersprungen. Zahlen, Namen und Codes verdienen einen zweiten Blick, denn ein falsches Zeichen wiegt dort schwerer als im Fließtext. Die unter dem Ergebnis angezeigte mittlere Erkennungssicherheit ist die Schätzung der Engine selbst, kein Versprechen.
Saubere Erkennung mit dem Handyfoto
Texterkennung funktioniert am besten bei einer flach liegenden Seite mit scharfem, gleichmäßig beleuchtetem Text, frontal fotografiert, etwa in der Schärfe eines 300-dpi-Scans. Füllen Sie den Bildausschnitt mit dem Text, vermeiden Sie Schatten und Reflexe und halten Sie still, bis der Fokus sitzt. Sehr große Fotos werden vor der Erkennung auf 2600 px an der langen Kante verkleinert – normaler Buch- und Dokumenttext bleibt dabei voll lesbar, und das spart Speicher und Zeit.
Ist die Seite schief oder verschattet, schicken Sie sie zuerst durch den LensUp-Scanner: Perspektivkorrektur und Schattenentfernung liefern eine flache, kontrastreiche Seite, und das vom Scanner heruntergeladene JPG oder PNG ist hier eine gute Vorlage. Screenshots nimmt die Erkennung ebenfalls – meist der einfachste Fall überhaupt.
Wenn die lokale Engine nicht reicht: mit Pro nachbessern
Tesseract, die quelloffene Engine hinter der kostenlosen Verarbeitung, liest keine mathematische Notation und tut sich schwer mit Tabellen ohne Linien oder mit verbundenen Zellen. Für solche Seiten kann das Ergebnisfeld „Mit Pro nachbessern“ anbieten – eine kostenpflichtige Option, die erscheint, sobald Zahlungen auf der Website freigeschaltet sind: Das ganze Foto wird einmal über den LensUp-Server an Mathpix gesendet – einen kommerziellen Erkennungsdienst für Formeln und Tabellen –, und dessen Markdown ersetzt das lokale Ergebnis, mit Formeln als LaTeX zwischen Dollarzeichen und Tabellen als Markdown-Tabellen. LensUp speichert unterwegs nichts (Mathpix verarbeitet das Foto nach seinen eigenen Bedingungen); das lokale Ergebnis bleibt einen Klick entfernt.
Pro wird pro Nutzung bezahlt, damit die kostenlose Verarbeitung kostenlos und lokal bleiben kann: Solange es angeboten wird, melden Sie sich per E-Mail-Link an (ohne Passwort), kaufen einmalig und ohne Abo 50 Nutzungen für 4,99 USD, und jede Pro-Nachbesserung verbraucht eine. Schlägt der Aufruf beim Anbieter fehl, wird keine Nutzung abgezogen.
Gemischte Sprachen, auf dem Gerät, mit Absicht
Die Seite bietet 21 Sprachen: Englisch, Französisch, Deutsch, Spanisch, Portugiesisch, Italienisch, Polnisch, Türkisch, Indonesisch, Vietnamesisch, Chinesisch (vereinfacht und traditionell), Japanisch, Koreanisch, Russisch, Arabisch, Persisch, Urdu, Hindi, Bengalisch und Thai – die Sprachen, die LensUp selbst spricht. Jede Sprache ist ein eigenes Paket, das erst geladen wird, wenn Sie sie wählen: Für eine französische Seite wird ein 0,7-MB-Sprachpaket geladen, für eine chinesische eines mit etwa 1,7 MB – nie alle Pakete auf einmal. Wählen Sie die Sprache, die tatsächlich gedruckt ist, und fügen Sie bei gemischten Seiten eine zweite hinzu; Englisch wird zu Koreanisch, Russisch, Arabisch, Persisch, Urdu, Hindi, Bengalisch und Thai automatisch mitgeladen, weil diese Pakete englische Wörter sonst in ähnlich aussehende Buchstaben verwandeln. Mit dem falschen Paket entstehen Bruchstücke statt Markdown, die Statuszeile sagt es, und „Sprache erkennen“ findet das richtige Paket, indem es je Schriftsystem eines ausprobiert – so wird auch eine gemischte Seite zu sauberem Markdown.
Alles läuft lokal mit einer quelloffenen Engine, so wie LensUp auch sonst Bilder verarbeitet: kein Upload, kein Konto, keine Kopie Ihres Fotos oder seines Textes auf einem Server. Engine-Dateien und Pakete kommen von lensup.ai und werden vom Browser zwischengespeichert, sodass die zweite Erkennung in einer Sprache sofort startet. Die Scanner-Werkzeuge selbst enthalten weiterhin keine Texterkennung und erzeugen keine durchsuchbaren PDFs.
Häufige Fragen
Verlässt das Bild mein Gerät, wenn ich ein Bild in Markdown umwandle?
Bei der kostenlosen Verarbeitung nicht: OCR-Engine und das gewählte Sprachpaket werden in Ihren Browser geladen, und die Erkennung läuft dort – Foto, erkannter Text und .md-Datei erreichen nie einen LensUp-Server. Die einzige Ausnahme ist ausdrücklich und freiwillig: Wo das Ergebnisfeld „Mit Pro nachbessern“ anbietet (eine kostenpflichtige Option, die bei freigeschalteten Zahlungen erscheint), sendet dieser Klick das ganze Foto über LensUp an Mathpix (einen kommerziellen Erkennungsdienst für Formeln und Tabellen) und bringt dessen Markdown zurück; LensUp speichert unterwegs nichts (Mathpix verarbeitet das Foto nach seinen eigenen Bedingungen), es braucht eine Anmeldung per E-Mail und bezahlte Nutzungen (50 Nutzungen für einmalig 4,99 USD), und das lokale Ergebnis lässt sich wiederherstellen.
Welche Sprachen unterstützt die Umwandlung von Bild in Markdown?
Einundzwanzig gedruckte Sprachen: Englisch, Französisch, Deutsch, Spanisch, Portugiesisch, Italienisch, Polnisch, Türkisch, Indonesisch, Vietnamesisch, Chinesisch (vereinfacht und traditionell), Japanisch, Koreanisch, Russisch, Arabisch, Persisch, Urdu, Hindi, Bengalisch und Thai. Eine Seite kann zwei davon enthalten: Wählen Sie die Hauptsprache, fügen Sie für gemischte Seiten eine zweite hinzu, und Englisch wird zu Koreanisch, Russisch, Arabisch, Persisch, Urdu, Hindi, Bengalisch und Thai automatisch mitgelesen, weil diese Pakete allein englische Wörter in ähnlich aussehende Buchstaben verwandeln. Handschrift wird in keiner Sprache unterstützt.
Warum ist Text falsch oder fehlt?
Prüfen Sie zuerst das Sprachpaket: Der Hinweis unter dem Markdown bietet „Sprache erkennen“ an, das je Schriftsystem ein OCR-Paket ausprobiert und das beste behält. Danach das Foto: Unschärfe, Reflexe, Schatten, Schräglage, kleine Schrift, Zierschriften und unruhige Hintergründe senken die Qualität, und Tabellen oder mehrspaltige Seiten können in falscher Reihenfolge herauskommen. Fotografieren Sie die Seite flach und scharf neu oder bereinigen Sie sie zuerst im Scanner, und prüfen Sie das Markdown, bevor Sie es verwenden.