Firecrawl
Descripción
Frente a scrapers que se quedan en HTML crudo, páginas que no cargan y un lío de proxies, esta API cubre el 96 % de la web —también las que dependen de JavaScript— y entrega Markdown limpio, JSON estructurado o capturas, con una latencia P95 de 3,4 segundos en millones de páginas.
Unifica búsqueda, extracción e interacción: buscas en la web y recibes el contenido completo de los resultados; conviertes cualquier URL; recorres un sitio entero o descubres su mapa de URLs de un solo golpe. Antes de extraer puedes hacer clic, desplazarte, escribir o esperar, y extraer texto de PDF y DOCX alojados en la web.
- Proxies rotativos, límites de tasa y contenido bloqueado por JS, sin configuración
- Salida pensada para LLM: menos tokens y datos más limpios
- SDK en Python y Node.js, CLI y clientes en Rust, Go, Java, PHP y más
- Código abierto (AGPL-3.0) y servicio alojado
Conexión con agentes
Se enlaza con agentes de IA o clientes MCP con un comando. Describes lo que necesitas y el agente recopila los datos; el scrape por lotes procesa miles de URLs de forma asíncrona.
Tecnologías y temas
-
Agentes IA
Salida lista para LLM e integración con clientes MCP
-
Búsqueda web
Busca y devuelve el contenido completo de los resultados
-
Crawler
Recorre un sitio o descubre su mapa de URLs en una petición
-
Extracción de datos
JSON estructurado, PDF, DOCX y acciones en la página
-
Web scraping
Convierte URLs en Markdown, HTML, JSON o capturas