html-to-markdown
Repositorios de código abierto monitorizados etiquetados con html-to-markdown, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a html-to-markdown en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con html-to-markdown.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
La API de contexto para buscar, extraer e interactuar con la web a gran escala. 🔥
★ 175.781+1747Variación de estrellas de los últimos 7 días - #2★ 11.418+11Variación de estrellas de los últimos 7 días
- #3
Herramienta de Python y línea de comandos para recopilar texto y metadatos en la web: rastreo, extracción y salida en CSV, JSON, HTML, MD, TXT, XML
★ 6754+26Variación de estrellas de los últimos 7 días - #4
⚙️ Convierte HTML a Markdown. Incluso funciona con sitios web completos y se puede extender mediante reglas.
★ 3806+7Variación de estrellas de los últimos 7 días - #5
AnyCrawl 🚀: Un rastreador en Node.js/TypeScript que convierte sitios web en datos listos para LLM y extrae resultados estructurados de SERP de Google/Bing/Baidu, etc. Multihilo nativo para procesamiento masivo.
★ 3446+31Variación de estrellas de los últimos 7 días - #6
Analizador de CommonMark/Markdown para Java con AST a nivel de código fuente. Compatible con CommonMark 0.28, emulación de pegdown, kramdown, markdown.pl y MultiMarkdown. Incluye módulos de conversión de HTML a MD, MD a PDF y MD a DOCX.
★ 2640+0Variación de estrellas de los últimos 7 días - #7
Extracción rápida de contenido web local-first para LLM. Web scraping, rastreo y extracción de datos estructurados, todo desde Rust. CLI, API REST y servidor MCP.
★ 2318+10Variación de estrellas de los últimos 7 días - #8
Un lenguaje de consulta para Markdown similar a jq para procesamiento en línea de comandos
★ 1027+4Variación de estrellas de los últimos 7 días - #9
Alternativa rápida y ligera a Firecrawl/Tavily escrita en Rust. Web scraper, crawler y API de búsqueda con servidor MCP para agentes de IA. API compatible con Firecrawl (/scrape, /crawl, /search). 2.3 veces más rápido que Tavily y 1.5 veces más rápido que Firecrawl en benchmarks de 1000 URLs. 6 MB de RAM, binario único. Autohospedable o mediante nube gestionada.
★ 952+87Variación de estrellas de los últimos 7 días - #10
Una herramienta ligera y potente de código abierto de la comunidad de desarrolladores helloworld para convertir HTML a Markdown con un solo clic, compatible con la conversión de artículos de múltiples plataformas y su descarga local.
★ 825+1Variación de estrellas de los últimos 7 días - #11
🔥 Este repositorio contiene ejemplos completos de aplicaciones, incluyendo sitios web y otros proyectos, desarrollados con Firecrawl.
★ 814+5Variación de estrellas de los últimos 7 días - #12
Alternativa a Firecrawl 100% gratuita y de código abierto para el borde (edge), con mejor extracción de enlaces para agentes, que puedes desplegar tú mismo en Cloudflare o Vercel.
★ 668+6Variación de estrellas de los últimos 7 días - #13
Convertidor y crawler de HTML a Markdown.
★ 626+0Variación de estrellas de los últimos 7 días - #14
Infraestructura web de código abierto para IA. Extrae, rastrea y automatiza la web, limpia Markdown, gestiona sesiones de navegador y prepara datos para tus agentes.
★ 559+0Variación de estrellas de los últimos 7 días - #15
¡Es hora de simplificar tu marcado! Convertidor de HTML a markdown. Breakdance es altamente flexible, modular y fácil de usar.
★ 539+0Variación de estrellas de los últimos 7 días - #16
Exporta páginas de Atlassian Confluence como archivos Markdown.
★ 538+8Variación de estrellas de los últimos 7 días