Acerca de MarkOut
El texto resaltado debería ser fácil de reutilizar. MarkOut lo convierte en Markdown — sin enviar tu PDF a ningún lugar.
Por qué existe MarkOut
Todos los estudiantes, investigadores y escritores conocen el ritual: resaltas un PDF y luego vuelves a escribir los pasajes en tus notas. Las herramientas existentes de "PDF a texto" o bien exigen subir tu documento a un servidor de terceros, o destrozan la estructura de lo que seleccionaste.
MarkOut se construyó con dos reglas simples:
- Tu PDF nunca sale de tu dispositivo. La extracción, detección y OCR se ejecutan íntegramente en la pestaña del navegador.
- Obtienes Markdown limpio, no un muro de texto. Los resaltados se extraen en orden de lectura, agrupados por página y sección, listos para pegar en cualquier app de notas o LLM.
Cómo funciona por debajo
La misma pipeline neuronal se ejecuta en todos los PDF, digitales o escaneados:
- Modelo YOLO26 personalizado — un modelo de detección entrenado en resaltados (ONNX autoalojado) encuentra las áreas marcadas en cada página.
- Modelo YOLO26 personalizado — para páginas escaneadas o capturas de pantalla, un modelo de detección entrenado con resaltados (ONNX autoalojado) encuentra las áreas marcadas.
- PaddleOCR — el texto reconocido se reconstruye con un algoritmo de orden de lectura (gap-tree + diseño de columnas), para que los documentos de varias columnas salgan en el orden correcto.
¿Quieres los detalles? Ver Cómo funciona.
Código abierto
MarkOut es gratuito y de código abierto. El código, los modelos y este sitio están en GitHub — puedes leerlo, hacer fork, reportar problemas o sugerir funciones.
Si MarkOut te ahorra tiempo, una estrella en GitHub es la mejor forma de agradecer:
Construido con
Todos los modelos de IA están autoalojados y se sirven desde este sitio — sin CDN de terceros, sin rastreo.