Über MarkOut
Markierter Text sollte einfach wiederverwendbar sein. MarkOut verwandelt ihn in Markdown — ohne dein PDF jemals irgendwohin zu senden.
Warum es MarkOut gibt
Jede Studentin, jeder Forscher und jede Autorin kennt das Ritual: Man markiert ein PDF und tippt die Passagen anschließend in Notizen ab. Bestehende „PDF-zu-Text"-Tools verlangen entweder das Hochladen des Dokuments auf einen Fremdserver oder zerstören die Struktur der Auswahl.
MarkOut wurde nach zwei einfachen Regeln gebaut:
- Dein PDF verlässt nie dein Gerät. Extraktion, Erkennung und OCR laufen vollständig lokal im Browser-Tab.
- Du bekommst sauberes Markdown, keine Textwand. Markierungen werden in Lesereihenfolge extrahiert, nach Seite und Abschnitt gruppiert — bereit zum Einfügen in jede Notiz-App oder jeden LLM.
So funktioniert es unter der Haube
Dieselbe neuronale Pipeline läuft für jedes PDF, digital oder gescannt:
- YOLO26-Custom-Modell — ein auf Markierungen trainiertes Erkennungsmodell (selbst gehostetes ONNX) findet die markierten Bereiche auf jeder Seite.
- PaddleOCR — der erkannte Text wird mit einem Lesereihenfolge-Algorithmus (Gap-Tree + Spaltenlayout) rekonstruiert, damit mehrspaltige Dokumente in der richtigen Reihenfolge erscheinen.
Mehr Details? Siehe So funktioniert's.
Open Source
MarkOut ist kostenlos und Open Source. Code, Modelle und diese Website stehen auf GitHub — lies sie, forke sie, melde Probleme oder schlage Funktionen vor.
Wenn MarkOut dir Zeit spart, ist ein Stern auf GitHub die beste Art, dich zu bedanken:
Gebaut mit
Alle KI-Modelle sind selbst gehostet und werden von dieser Website ausgeliefert — keine Drittanbieter-CDN, kein Tracking.