PROJECT / linkedin-markdownificator
linkedin-markdownificator
Fork OSS de una CLI que exporta el perfil completo de LinkedIn a Markdown (y JSON) para webs personales, CVs y agentes de IA. Sin API oficial: Selenium + HTML cacheado, pensado para no duplicar el CV a mano.
Problema
LinkedIn no da API a developers individuales. El perfil público es incompleto y mantener LinkedIn + web/CV al día es trabajo doble. Cuando LinkedIn cambia el DOM React, los scrapers se rompen.
Qué hice
Retomé el fork y lo hice resiliente al DOM post-2025 (de clases artdeco a componentkey). Externalicé selectores en JSON, sumé scroll progresivo para componentes lazy, export JSON, templates Jinja2, modo headless/cached, y una suite de 26 tests de integración con Pytest + Ruff.
Destacados
- Exporta el perfil completo (no solo el público) a Markdown y JSON, listo para CVs y agentes.
- Resiliente al DOM React post-2025: selectores externalizados en JSON en vez de hardcodeados.
- Scroll progresivo para secciones lazy, más modo headless y cacheo de HTML.
- Templates Jinja2 intercambiables y suite de 26 tests de integración con Pytest + Ruff.
Stack
- Python
- Selenium
- BeautifulSoup
- Parsel
- Jinja2
- Pytest
- Ruff
Links