Firecrawl es una API que permite buscar, extraer y navegar por la web a escala, entregando el contenido limpio en markdown, JSON estructurado, capturas de pantalla o texto listo para modelos de lenguaje. Se encarga de los problemas típicos del scraping —proxies rotativos, límites de tasa, contenido bloqueado por JavaScript— sin que tengas que configurar nada.
A través del servidor MCP, un agente puede pedirle a Firecrawl que busque en la web y devuelva el contenido completo de los resultados, que convierta una URL concreta en markdown o datos estructurados, que rastree un sitio entero desde una sola petición, que descubra todas las URLs de un dominio, o que use el modo Agent para reunir información sin conocer las URLs de antemano, incluso con un esquema de salida definido con Pydantic.
Para usarlo desde un cliente MCP solo necesitas una FIRECRAWL_API_KEY (se obtiene registrándose en firecrawl.dev) y ejecutar el servidor con npx. También existe una versión self-hosted bajo licencia AGPL-3.0 si prefieres no depender del servicio en la nube.