Firecrawl

Firecrawl

Verificado
codigo

API de scraping y crawling que convierte cualquier web en Markdown o JSON limpio, listo para alimentar modelos de IA.

Qué es Firecrawl y cómo funciona

Firecrawl es una API de scraping y rastreo web que convierte cualquier página en datos limpios y listos para modelos de lenguaje. Le pasas una URL y devuelve Markdown ordenado o JSON estructurado, sin menús, anuncios ni etiquetas HTML sobrantes. Renderiza JavaScript, sigue enlaces y rastrea sitios completos, así que sirve tanto para una página suelta como para una documentación entera.

¿Para quién es Firecrawl?

Es una herramienta para desarrolladores y equipos de IA que necesitan datos web dentro de su producto: sistemas RAG, agentes que consultan internet, buscadores internos, enriquecimiento de datos y análisis de competencia. También la usan equipos no técnicos a través de integraciones con n8n, Zapier, LangChain o Dify, donde Firecrawl es el nodo que trae el contenido.

¿Cómo funciona Firecrawl?

Creas una cuenta, obtienes tu clave de API y llamas al endpoint que necesitas. Scrape lee una sola página; Crawl recorre un sitio entero siguiendo sus enlaces; Map devuelve todas las URL de un dominio; Search busca en la web y opcionalmente raspa los resultados. Hay SDK para Python y Node, un servidor MCP para conectarlo a asistentes como Claude, y el código del proyecto es abierto, así que también se puede autoalojar. El consumo se mide en créditos: un crédito por página.

Funcionalidades principales

  • Scrape: cualquier URL convertida en Markdown, HTML limpio o JSON
  • Crawl: rastreo de un sitio completo siguiendo enlaces, sin necesidad de sitemap
  • Map: listado rápido de todas las URL de un dominio
  • Search: búsqueda web con opción de raspar los resultados en la misma llamada
  • Extract: extracción estructurada guiada por esquema y por instrucciones en lenguaje natural
  • Renderizado de JavaScript y acciones en el navegador (clics, esperas, formularios)
  • Monitorización de páginas para detectar cambios
  • Capturas de pantalla y extracción de enlaces e imágenes
  • SDK de Python y Node, servidor MCP e integraciones con LangChain, LlamaIndex, n8n y Zapier
  • Proyecto de código abierto con opción de autoalojamiento

Precios de Firecrawl

  • Plan Free (0 $/mes): 1.000 créditos al mes y 2 peticiones simultáneas
  • Plan Hobby (16 $/mes con facturación anual): 5.000 créditos y 5 peticiones simultáneas
  • Plan Standard (83 $/mes con facturación anual): 100.000 créditos y 25 peticiones simultáneas
  • Plan Growth (333 $/mes con facturación anual): 500.000 créditos y 50 peticiones simultáneas
  • Plan Scale (599 $/mes con facturación anual): 1.000.000 de créditos y 100 peticiones simultáneas
  • Plan Enterprise: a medida, con SLA, soporte dedicado y retención cero de datos

Coste en créditos: 1 crédito por página en scrape, crawl, map y monitorización; 2 créditos por cada 10 resultados de búsqueda; 2 créditos por minuto de navegador.

Oferta: 10 % de descuento en el primer pedido para quien entra desde este enlace.

Casos de uso prácticos

  1. Chatbot sobre tu documentación: rastreas el sitio entero y lo indexas en Markdown limpio
  2. Agente con acceso a internet: el agente busca, lee la página y responde con la fuente
  3. Vigilancia de precios: raspas las páginas de producto de la competencia de forma periódica
  4. Investigación de mercado: extraes datos estructurados de decenas de webs con el mismo esquema
  5. Migración de contenido: conviertes un sitio antiguo en ficheros Markdown reutilizables

Ventajas de Firecrawl

  • La salida está pensada para LLM: nada de limpiar HTML a mano
  • Rastrea sitios completos sin depender del sitemap
  • Maneja webs con mucho JavaScript que rompen los scrapers simples
  • Código abierto y autoalojable si no quieres depender del servicio en la nube
  • Integraciones y MCP listos para conectarlo a agentes sin escribir pegamento

Limitaciones

  • Los créditos no se acumulan de un mes a otro en los planes de autoservicio
  • Webs con protección anti-bot fuerte siguen siendo un problema
  • A gran volumen, el coste por crédito se nota en la factura
  • Rasparlo todo no exime de revisar los términos de uso y los derechos del sitio de origen

¿Cómo se compara Firecrawl con otras herramientas?

Sus alternativas son Apify, ScrapingBee, Jina Reader y Context.dev. Apify ofrece un mercado de scrapers configurables pero con más curva de entrada; ScrapingBee se centra en proxies y renderizado; Jina Reader es más simple y gratuito para casos básicos. Firecrawl acierta en el punto medio: una API sencilla, salida limpia para IA y rastreo de sitios enteros con muy poco código.

Cómo empezar con Firecrawl en 4 pasos

  1. Crea una cuenta gratuita y copia tu clave de API
  2. Prueba un scrape sobre una URL cualquiera y revisa el Markdown que devuelve
  3. Lanza un crawl sobre una documentación completa y guarda el resultado
  4. Conecta el SDK o el servidor MCP a tu aplicación o a tu agente
By Jon Kraayen
Jon Kraayenbrink