Skip to main content
Firecrawl MCP ofrece herramientas para encontrar, extraer, interactuar con y supervisar contenido web. Tu cliente MCP recibe el esquema de entrada exacto de cada herramienta disponible al conectarse.

Disponibilidad de herramientas

Comienza con Primeros pasos y elige Para agentes o Para personas. Algunas herramientas opcionales pueden deshabilitarse mediante el entorno o la política del equipo.

Selecciona una herramienta

La antigua herramienta MCP Extract está obsoleta y no forma parte del conjunto actual de herramientas. Usa Scrape con formato JSON para una página conocida, o Agent cuando Firecrawl deba descubrir las fuentes. Consulta Elegir el extractor de datos para ver la comparación completa.
Usa el esquema que muestra tu cliente MCP para los argumentos actuales. Las guías de funcionalidad a continuación explican el comportamiento subyacente de Firecrawl sin duplicar aquí esos esquemas.

Comportamiento importante

Un MCP Server local conectado a una API de Firecrawl autogestionada puede leer filePath directamente. El servidor alojado no puede leer archivos de tu máquina, por lo que utiliza un proceso de dos llamadas:
  1. Llama a firecrawl_parse con filePath para recibir un comando de carga y uploadRef.
  2. Ejecuta el comando de carga en la máquina que puede leer el archivo.
  3. Vuelve a llamar a firecrawl_parse con el uploadRef devuelto.
El comando de carga usa un objetivo firmado de corta duración y no contiene tu clave de API de Firecrawl. Usa firecrawl_scrape para una URL de documento pública.
firecrawl_crawl normalmente inicia un rastreo y consulta su estado hasta que alcanza un estado terminal antes de responder. Si se agota el tiempo de espera, reanuda el trabajo con firecrawl_check_crawl_status y el ID del rastreo. Usa la misma herramienta de estado para un rastreo creado fuera de la llamada MCP actual.firecrawl_agent es asíncrono: devuelve un ID de trabajo y firecrawl_agent_status comprueba ese trabajo hasta que se complete o falle.
Comienza con una url o reutiliza el scrapeId de una llamada a Scrape anterior. Cuando finalice el flujo de trabajo, llama a firecrawl_interact_stop con el scrapeId para liberar la sesión.
La familia firecrawl_monitor_* crea, enumera, actualiza, ejecuta e inspecciona monitores recurrentes. firecrawl_monitor_delete elimina permanentemente un monitor y solo debe llamarse cuando el usuario tenga la intención explícita de eliminarlo.
Las herramientas de Alexandria requieren una sesión autenticada. Las sesiones sin clave no tienen acceso a las herramientas de Alexandria.
  1. Descubrir. Con autenticación, firecrawl_search usa sources: ["web", "alexandria"] de forma predeterminada y devuelve las herramientas coincidentes en data.tools. Usa sources: ["alexandria"] para obtener solo herramientas, o sources: ["web"] para omitir el descubrimiento semántico de herramientas.
  2. Inspeccionar. Llama a firecrawl_find_tools sin argumentos para explorar categorías, luego providers y luego herramientas. Usa query o urls para encontrar herramientas para una tarea o un sitio web. Usa capabilities para leer el contrato completo de una herramienta. Usa el nextTool devuelto para continuar con el siguiente paso.
  3. Ejecutar. Llama a firecrawl_scrape con alexandria: {provider, capability, options} en lugar de url. Envía un array de hasta 10 llamadas para ejecutarlas a la vez. Cada resultado en data.alexandria incluye data o un error.
El descubrimiento es gratuito. Cada ejecución tiene el costo indicado en su herramienta. Si un provider requiere aceptar términos, la herramienta devuelve THIRD_PARTY_DATA_TERMS_REQUIRED con requiresAction.url. Proporciona esa URL a un administrador de la organización para que acepte los términos en el Dashboard de Firecrawl. El agente no debe aceptar los términos. Cuando el administrador lo confirme, vuelve a enviar la misma llamada.
Establece FIRECRAWL_NO_SEARCH_FEEDBACK=1 para evitar que se registre firecrawl_search_feedback. Establece FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 para evitar que se registre firecrawl_feedback.

Guía de funcionalidad

Scrape

Extrae contenido o campos estructurados de una URL.

Search

Encuentra fuentes relevantes en la web, noticias, imágenes y fuentes para desarrolladores.

Research Index

Busca artículos, lee pasajes y sigue citas.

Developer Index

Responde preguntas de programación a partir de issues, PRs, READMEs y documentación.

Rastreo

Recorre y extrae un sitio o una sección.

Procesar

Convierte archivos en salidas listas para LLM.

Interact

Opera páginas dinámicas en una sesión de navegador activa.

Agent

Realiza investigaciones autónomas en múltiples fuentes.

Monitoring

Supervisa cambios en las páginas y recibe notificaciones.

Alexandria

Encuentra y ejecuta herramientas de datos de providers externos.

Solución de problemas

  • Falta una herramienta: confirme el modo de conexión en Primeros pasos, vuelva a conectarse o reinicie el cliente y compruebe si la política del equipo deshabilita herramientas opcionales.
  • El cliente devuelve 401: primero compruebe la URL del servidor configurada.
    • Si la URL configurada es /v2/mcp-oauth, vuelva a iniciar sesión a través del cliente.
    • Si es /v2/mcp, reemplace la clave de API en ese servidor o actualice la URL del servidor existente a /v2/mcp-oauth y complete el inicio de sesión.
    • Inicie una nueva sesión de cliente después de cualquiera de los cambios.
  • El cliente ha alcanzado el límite de tasa: consulte los límites de tasa actuales, espere el intervalo antes de reintentar o cambie del acceso sin clave al acceso autenticado.