Firecrawl

IA / ML

Descripción

Frente a scrapers que se quedan en HTML crudo, páginas que no cargan y un lío de proxies, esta API cubre el 96 % de la web —también las que dependen de JavaScript— y entrega Markdown limpio, JSON estructurado o capturas, con una latencia P95 de 3,4 segundos en millones de páginas.

Unifica búsqueda, extracción e interacción: buscas en la web y recibes el contenido completo de los resultados; conviertes cualquier URL; recorres un sitio entero o descubres su mapa de URLs de un solo golpe. Antes de extraer puedes hacer clic, desplazarte, escribir o esperar, y extraer texto de PDF y DOCX alojados en la web.

  • Proxies rotativos, límites de tasa y contenido bloqueado por JS, sin configuración
  • Salida pensada para LLM: menos tokens y datos más limpios
  • SDK en Python y Node.js, CLI y clientes en Rust, Go, Java, PHP y más
  • Código abierto (AGPL-3.0) y servicio alojado

Conexión con agentes

Se enlaza con agentes de IA o clientes MCP con un comando. Describes lo que necesitas y el agente recopila los datos; el scrape por lotes procesa miles de URLs de forma asíncrona.

Tecnologías y temas

  • Agentes IA

    Salida lista para LLM e integración con clientes MCP

  • Búsqueda web

    Busca y devuelve el contenido completo de los resultados

  • Crawler

    Recorre un sitio o descubre su mapa de URLs en una petición

  • Extracción de datos

    JSON estructurado, PDF, DOCX y acciones en la página

  • Web scraping

    Convierte URLs en Markdown, HTML, JSON o capturas