Skip to content
KitploitKITPLOIT
FerramentasBlog
Enviar
FerramentasBlog
Enviar

Ferramentas de Hacking, PenTest e Cibersegurança para o seu Arsenal de Segurança!

Kitploit é um diretório de ferramentas de hacking, cibersegurança e pentesting. Descubra as últimas atualizações de projetos para encontrar vulnerabilidades, analisar sistemas, automatizar testes e fortalecer sua segurança.

··Feeds·Contato·Privacidade·© 2026 Kitploit

Diretório de Ferramentas

Categorias

Ver todas as categorias
Loading categories
firecrawl-mcp-server — Servidor MCP que fornece capacidades de scraping web, rastreamento e pesquisa para agentes de IA. Suporta extração de dados estruturados, navegação interativa e pesquisa aprofundada através de uma API unificada. | Kitploit
Ferramentas/GitHubGitHub/firecrawl/firecrawl-mcp-server
Coleta de InformaçõesUtilitários e FrameworksRastreador
GitHubfirecrawl/firecrawl-mcp-server

firecrawl-mcp-server

Servidor MCP que fornece capacidades de scraping web, rastreamento e pesquisa para agentes de IA. Suporta extração de dados estruturados, navegação interativa e pesquisa aprofundada através de uma API unificada.

Ver Repositório
Site
7.2k8436há 1 diaRevisado pelo Kitploit

Mais Populares

Ver todos →

Descubra as ferramentas mais usadas pela nossa comunidade.

Explore todas as ferramentas

Navegue pela nossa coleção de ferramentas

Ver todas as ferramentas →
Compartilhar

Firecrawl MCP Server

Um servidor Model Context Protocol (MCP) que traz o Firecrawl para agentes de IA compatíveis com MCP — pesquise, faça scraping e interaja com a web em tempo real para obter contexto limpo e pronto para agentes.

Muito obrigado a @vrknetha e @knacklabs pela implementação inicial!

Recursos

  • Pesquise na web e obtenha o conteúdo completo da página
  • Faça scraping de qualquer URL para obter dados limpos e estruturados
  • Interaja com páginas — clique, navegue e opere
  • Pesquisa profunda com agente autônomo
  • Tentativas automáticas e limitação de taxa
  • Suporte em nuvem e auto-hospedado
  • Suporte SSE

Experimente o nosso Servidor MCP no playground do MCP.so ou no Klavis AI.

Instalação

MCP Hospedado (nível gratuito sem chave)

Conecte-se ao servidor remoto hospedado sem configuração:``` https://mcp.firecrawl.dev/v2/mcp

root@kitploit:~
Na camada gratuita sem chave, `scrape`, `search` e `interact` funcionam sem uma API key (com limite de taxa). Outras ferramentas como `crawl`, `map`, `agent` e `extract` ainda precisam de uma chave.

Prefira uma API key ou OAuth sempre que o usuário puder se inscrever. Isso desbloqueia o conjunto completo de ferramentas e limites mais altos. Com uma chave, use:```
https://mcp.firecrawl.dev/{FIRECRAWL_API_KEY}/v2/mcp

Consulte a documentação do servidor MCP e o guia de integração do agente para obter detalhes de configuração.

Executando com npx```bash

env FIRECRAWL_API_KEY=fc-YOUR_API_KEY npx -y firecrawl-mcp

root@kitploit:~
### Instalação Manual```bash
npm install -g firecrawl-mcp

Executando no Cursor

Configurando o Cursor 🖥️ Nota: Requer a versão 0.45.6+ do Cursor Para obter as instruções de configuração mais atualizadas, consulte a documentação oficial do Cursor sobre como configurar servidores MCP: Cursor MCP Server Configuration Guide

Para configurar o Firecrawl MCP no Cursor v0.48.6

  1. Abra as Configurações do Cursor
  2. Vá para Funcionalidades > Servidores MCP
  3. Clique em '+ Adicionar novo servidor MCP global'
  4. Insira o seguinte código: ```json { "mcpServers": { "firecrawl-mcp": { "command": "npx", "args": ["-y", "firecrawl-mcp"], "env": { "FIRECRAWL_API_KEY": "YOUR-API-KEY" } } } }
    root@kitploit:~

To configure Firecrawl MCP in Cursor v0.45.6

  1. Abra as Configurações do Cursor
  2. Vá para Features > MCP Servers
  3. Clique em "+ Add New MCP Server"
  4. Insira o seguinte:
    • Nome: "firecrawl-mcp" (ou o nome de sua preferência)
    • Tipo: "command"
    • Comando: env FIRECRAWL_API_KEY=your-api-key npx -y firecrawl-mcp

Se você estiver usando Windows e estiver enfrentando problemas, tente cmd /c "set FIRECRAWL_API_KEY=your-api-key && npx -y firecrawl-mcp"

Substitua your-api-key pela sua chave da API do Firecrawl. Se você ainda não tem uma, pode criar uma conta e obtê-la em https://www.firecrawl.dev/app/api-keys

Após adicionar, atualize a lista de servidores MCP para ver as novas ferramentas. O Composer Agent usará automaticamente o Firecrawl MCP quando apropriado, mas você pode solicitá-lo explicitamente descrevendo suas necessidades de raspagem web. Acesse o Composer via Command+L (Mac), selecione "Agent" ao lado do botão de envio e digite sua consulta.

Executando no Windsurf

Adicione isto ao seu ./codeium/windsurf/model_config.json:

root@kitploit:~
{
  "models": {
    "Firecrawl MCP": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "your-api-key-here"
      }
    }
  }
}
``````json
{
  "mcpServers": {
    "mcp-server-firecrawl": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "YOUR_API_KEY"
      }
    }
  }
}

Executando com Streamable HTTP Local Mode

Para executar o servidor usando Streamable HTTP localmente em vez do transporte padrão stdio:```bash env HTTP_STREAMABLE_SERVER=true FIRECRAWL_API_KEY=fc-YOUR_API_KEY npx -y firecrawl-mcp

root@kitploit:~
Use o URL: http://localhost:3000/mcp

### Instalando via Smithery (Legado)

Para instalar o Firecrawl para o Claude Desktop automaticamente via [Smithery](https://smithery.ai/server/@mendableai/mcp-server-firecrawl):```bash
npx -y @smithery/cli install @mendableai/mcp-server-firecrawl --client claude

Executando no VS Code

Para instalação com um clique, clique em um dos botões de instalação abaixo...

Install with NPX in VS Code Install with NPX in VS Code Insiders

Para instalação manual, adicione o seguinte bloco JSON ao seu arquivo de Configurações do Usuário (JSON) no VS Code. Você pode fazer isso pressionando Ctrl + Shift + P e digitando Preferences: Open User Settings (JSON).```json { "mcp": { "inputs": [ { "type": "promptString", "id": "apiKey", "description": "Firecrawl API Key", "password": true } ], "servers": { "firecrawl": { "command": "npx", "args": ["-y", "firecrawl-mcp"], "env": { "FIRECRAWL_API_KEY": "${input:apiKey}" } } } } }

root@kitploit:~
Opcionalmente, você pode adicioná-lo a um arquivo chamado `.vscode/mcp.json` no seu espaço de trabalho. Isso permitirá que você compartilhe a configuração com outros:

```json
{
  "mcpServers": {
    ...
  }
}
``````json
{
  "inputs": [
    {
      "type": "promptString",
      "id": "apiKey",
      "description": "Firecrawl API Key",
      "password": true
    }
  ],
  "servers": {
    "firecrawl": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "${input:apiKey}"
      }
    }
  }
}

Configuração

Variáveis de Ambiente

Obrigatório para API na Nuvem

  • FIRECRAWL_API_KEY: Sua chave de API do Firecrawl
    • Obrigatório ao usar API na nuvem (padrão)
    • Opcional ao usar instância auto-hospedada com FIRECRAWL_API_URL
  • FIRECRAWL_API_URL (Opcional): Endpoint de API personalizado para instâncias auto-hospedadas
    • Exemplo: https://firecrawl.your-domain.com
    • Se não fornecido, a API na nuvem será usada (requer chave de API)

MCP OAuth (Tokens de acesso Bearer)

O Firecrawl hospedado pode emitir tokens de acesso OAuth (fco_…) através do servidor de autorização em firecrawl.dev. Este servidor MCP encaminha qualquer credencial que ele resolver para a API do Firecrawl como Authorization: Bearer ….

  • Transportes de fluxo HTTP (CLOUD_SERVICE=true, HTTP_STREAMABLE_SERVER=true, ou SSE_LOCAL=true): Os clientes devem enviar Authorization: Bearer <fco_access_token> nas requisições MCP. Um token de acesso OAuth tem precedência sobre x-firecrawl-api-key / x-api-key quando ambos estão presentes.
  • stdio: Use FIRECRAWL_OAUTH_TOKEN para um token de acesso estático, ou continue usando FIRECRAWL_API_KEY para uma chave de API.

Use apenas tokens de acesso (fco_…). Tokens de atualização (fcr_…) devem ser trocados no endpoint de token, não passados para a API de scrape/search.

Exemplos de Configuração

Para uso da API na nuvem:```bash export FIRECRAWL_API_KEY=your-api-key

root@kitploit:~
Para instância self-hosted:```bash
# Required for self-hosted
export FIRECRAWL_API_URL=https://firecrawl.your-domain.com

# Optional authentication for self-hosted
export FIRECRAWL_API_KEY=your-api-key  # If your instance requires auth

Uso com o Claude Desktop

Adicione isso ao seu claude_desktop_config.json:```json { "mcpServers": { "mcp-server-firecrawl": { "command": "npx", "args": ["-y", "firecrawl-mcp"], "env": { "FIRECRAWL_API_KEY": "YOUR_API_KEY_HERE" } } } }

root@kitploit:~
## Como Escolher uma Ferramenta

Use este guia para selecionar a ferramenta certa para sua tarefa:

- **Se você sabe a URL exata que deseja:** use **scrape** (com formato JSON para dados estruturados)
- **Se você tem múltiplas URLs conhecidas:** chame **scrape** para cada URL. Se você precisar especificamente de uma operação em lote da API, use o endpoint de lote da API Firecrawl fora do MCP.
- **Se você precisa descobrir URLs em um site:** use **map**
- **Se você deseja pesquisar na web por informações:** use **search**
- **Se você precisa de pesquisa complexa em múltiplas fontes desconhecidas:** use **agent**
- **Se você quer analisar um site inteiro ou seção:** use **crawl** (com limites!)
- **Se você precisa de automação interativa do navegador** (clicar, digitar, navegar): use **interact** com uma URL para uma página nova, ou **scrape** + **interact** quando você já extraiu a página ou precisa de um controle mais fino da extração

### Tabela de Referência Rápida

| Ferramenta   | Melhor para                                     | Retorna                        |
| ------------ | ----------------------------------------------- | ------------------------------ |
| scrape       | Conteúdo de página única                        | JSON (preferido) ou markdown   |
| interact     | Interagir com uma URL ou página extraída        | Resultado da execução + scrapeId para modo URL |
| map          | Descobrir URLs em um site                       | URL[]                          |
| crawl        | Extração de múltiplas páginas (com limites)     | status/dados finais do crawl após polling interno |
| parse        | Arquivos e referências de upload hospedado      | markdown, JSON, ou saída de documento |
| extract      | Extração estruturada de URLs                    | Dados estruturados JSON        |
| search       | Pesquisa na web por informações                 | resultados[]                   |
| agent        | Pesquisa complexa em múltiplas fontes           | JSON (dados estruturados)      |
| monitor      | Verificações recorrentes de páginas             | metadados e diffs do monitor/check |
| research     | Pesquisa em artigos e repositórios GitHub       | resultados da pesquisa e correspondências de repositórios |

### Guia de Seleção de Formato

Ao usar `scrape`, escolha o formato correto:

- **Formato JSON (recomendado para a maioria dos casos):** Use quando precisar de dados específicos de uma página. Defina um esquema baseado no que precisa extrair. Isso mantém as respostas pequenas e evita o estouro do contexto.
- **Formato Markdown (use com moderação):** Apenas quando você realmente precisa do conteúdo completo da página, como ler um artigo inteiro para resumo ou analisar a estrutura da página.

## Ferramentas Disponíveis

### 1. Ferramenta Scrape (`firecrawl_scrape`)

Extrai conteúdo de uma única URL com opções avançadas.

**Melhor para:**

- Extração de conteúdo de página única, quando você sabe exatamente qual página contém as informações.

**Não recomendado para:**

- Extrair conteúdo de múltiplas páginas (use chamadas repetidas de scrape para URLs conhecidas, ou map + scrape para descobrir URLs primeiro, ou crawl para conteúdo completo da página)
- Quando você não tem certeza de qual página contém as informações (use search)

**Erros comuns:**

- Passar uma lista de URLs para uma única chamada de scrape. Chame scrape uma vez por URL no MCP. Se você precisar especificamente de uma operação em lote da API, use o endpoint de lote da API Firecrawl fora do MCP.
- Usar formato markdown por padrão (use formato JSON para extrair apenas o que precisa).

**Escolhendo o formato correto:**

- **Formato JSON (preferido):** Na maioria dos casos, use formato JSON com um esquema para extrair apenas os dados específicos necessários. Isso mantém as respostas focadas e evita o estouro do contexto.
- **Formato Markdown:** Apenas quando a tarefa realmente requer o conteúdo completo da página (por exemplo, resumir um artigo inteiro, analisar a estrutura da página).

**Exemplo de Prompt:**

> "Obtenha os detalhes do produto de https://example.com/product."

**Exemplo de Uso (formato JSON - preferido):**```json
{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com/product",
    "formats": [
      {
        "type": "json",
        "prompt": "Extract the product information",
        "schema": {
          "type": "object",
          "properties": {
            "name": { "type": "string" },
            "price": { "type": "number" },
            "description": { "type": "string" }
          },
          "required": ["name", "price"]
        }
      }
    ]
  }
}

Exemplo de uso (formato markdown - quando o conteúdo completo é necessário):```json { "name": "firecrawl_scrape", "arguments": { "url": "https://example.com/article", "formats": ["markdown"], "onlyMainContent": true } }

root@kitploit:~
**Exemplo de Uso (formato de branding - extrair identidade de marca):**```json
{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com",
    "formats": ["branding"]
  }
}

Formato de branding: Extrai identidade de marca abrangente (cores, fontes, tipografia, espaçamento, logotipo, componentes de UI) para análise de design ou replicação de estilo. Privacidade: Defina redactPII: true para retornar conteúdo com informações pessoais identificáveis ocultadas.

Retorna:

  • Dados estruturados JSON, markdown, perfil de branding ou outros formatos conforme especificado.

2. Ferramenta de Mapeamento (firecrawl_map)

Mapeie um site para descobrir todos os URLs indexados no site.

Melhor para:

  • Descobrir URLs em um site antes de decidir o que raspar
  • Encontrar seções específicas de um site

Não recomendado para:

  • Quando você já sabe qual URL específico precisa (use scrape)
  • Quando você precisa do conteúdo das páginas (use scrape após o mapeamento)

Erros comuns:

  • Usar crawl para descobrir URLs em vez de map

Exemplo de Prompt:

"Liste todos os URLs em example.com."

Exemplo de Uso:```json { "name": "firecrawl_map", "arguments": { "url": "https://example.com" } }

root@kitploit:~
**Retorna:**

- Array de URLs encontradas no site

### 3. Ferramenta de Pesquisa (`firecrawl_search`)

Pesquise na web e opcionalmente extraia conteúdo dos resultados da pesquisa.

**Melhor para:**

- Encontrar informações específicas em vários sites, quando você não sabe qual site possui a informação.
- Quando você precisa do conteúdo mais relevante para uma consulta

**Não recomendado para:**

- Quando você já sabe qual site raspar (use scrape)
- Quando você precisa de cobertura abrangente de um único site (use map ou crawl)

**Erros comuns:**

- Usar crawl ou map para perguntas abertas (use search em vez disso)

**Exemplo de Uso:**```json
{
  "name": "firecrawl_search",
  "arguments": {
    "query": "latest AI research papers 2023",
    "limit": 5,
    "lang": "en",
    "country": "us",
    "scrapeOptions": {
      "formats": ["markdown"],
      "onlyMainContent": true,
      "redactPII": true
    }
  }
}

Retorna:

  • Array de resultados de pesquisa (com conteúdo opcionalmente extraído), mais um campo id. Passe esse id para firecrawl_search_feedback depois de usar os resultados para reembolsar 1 crédito (a pesquisa custa 2) e melhorar a qualidade da pesquisa.

Exemplo de Prompt:

"Encontre os artigos de pesquisa mais recentes sobre IA publicados em 2023."

3b. Ferramenta de Feedback de Pesquisa (firecrawl_search_feedback)

Envia feedback estruturado sobre um resultado anterior de firecrawl_search. O primeiro feedback por id de pesquisa reembolsa 1 crédito e melhora a qualidade de pesquisa do Firecrawl. Idempotente por id de pesquisa.

Chame isso após cada pesquisa que você realmente usar (ou que não ajudou). Feedback ruim/parcial com missingContent é tão valioso quanto feedback bom.

Optar por não participar: defina FIRECRAWL_NO_SEARCH_FEEDBACK=1 (ou FIRECRAWL_DISABLE_SEARCH_FEEDBACK=1) no ambiente ao iniciar o servidor MCP. A ferramenta firecrawl_search_feedback não será registrada, então os agentes não podem chamá-la. Administradores de equipe também podem desabilitar o feedback no lado do servidor; nesse caso, a ferramenta é registrada, mas sempre retorna feedbackErrorCode: "TEAM_OPTED_OUT".

Campo mais importante: missingContent. É um array de itens específicos de conteúdo que o agente esperava encontrar, mas não encontrou. Uma entrada por tópico ausente — estes se agregam entre equipes e nos dizem o que indexar a seguir.

Limite diário de reembolso (por equipe, por dia UTC, padrão 100 créditos). Quando o creditsRefundedToday de uma equipe atinge dailyRefundCap, as submissões posteriores ainda registram feedback, mas não reembolsam mais créditos. A resposta define dailyCapReached: true. Os agentes devem parar de chamar esta ferramenta pelo resto do dia UTC quando virem essa flag.

Exemplo de Uso:```json { "name": "firecrawl_search_feedback", "arguments": { "searchId": "0193f6c5-1234-7890-abcd-1234567890ab", "rating": "good", "valuableSources": [ { "url": "https://docs.firecrawl.dev/features/search", "reason": "Most up-to-date description of /search." } ], "missingContent": [ { "topic": "Pricing for the search endpoint", "description": "No pricing tier table for /search specifically." }, { "topic": "Per-team rate limits" } ], "querySuggestions": "Boost docs.firecrawl.dev for queries that mention 'firecrawl'" } }

root@kitploit:~
**Retorna:**

- `{ success, feedbackId, creditsRefunded, alreadySubmitted? }` JSON.

### 3c. Ferramenta de Feedback Genérica (`firecrawl_feedback`)

Envia feedback estruturado para um trabalho de endpoint v2 concluído através de `/v2/feedback`.
Use isso para feedback no nível do endpoint em trabalhos de `scrape`, `parse`, `map` ou `search`.
Para qualidade de resultados de busca especificamente, prefira `firecrawl_search_feedback` porque inclui orientação específica de busca.

Mantenha o feedback conciso: use códigos de problema, tags, notas curtas, URLs, números de página e pequenos objetos de metadados. Não inclua saídas brutas de scrape/parse.

**Opt out:** defina `FIRECRAWL_NO_ENDPOINT_FEEDBACK=1` (ou `FIRECRAWL_DISABLE_ENDPOINT_FEEDBACK=1`) no ambiente ao iniciar o servidor MCP. A ferramenta `firecrawl_feedback` não será registrada, então os agentes não poderão chamá-la.

**Exemplo de Uso:**```json
{
  "name": "firecrawl_feedback",
  "arguments": {
    "endpoint": "scrape",
    "jobId": "0193f6c5-1234-7890-abcd-1234567890ab",
    "rating": "partial",
    "issues": ["missing_markdown"],
    "tags": ["docs"],
    "note": "The pricing table was missing from the markdown output.",
    "url": "https://example.com/pricing",
    "pageNumbers": [1],
    "metadata": {
      "format": "markdown"
    }
  }
}

Retorna:

  • { success, feedbackId, creditsRefunded, creditsRefundedToday?, dailyRefundCap?, dailyCapReached?, alreadySubmitted?, warning? } JSON.

4. Ferramenta de Rastreio (firecrawl_crawl)

Inicia um trabalho de rastreio, faz polling até atingir um estado terminal e retorna o estado/dados finais do rastreio.

Melhor para:

  • Extrair conteúdo de várias páginas relacionadas, quando você precisa de uma cobertura abrangente.

Não recomendado para:

  • Extrair conteúdo de uma única página (use scrape)
  • Quando os limites de token são uma preocupação (use map + scrape para um controle mais rigoroso)
  • Quando você precisa de resultados rápidos (o rastreio pode ser lento)

Aviso: As respostas do rastreio podem ser muito grandes e podem exceder os limites de token. Limite a profundidade do rastreio e o número de páginas, ou use map + scrape para um controle mais rigoroso.

Erros comuns:

  • Definir limit ou maxDiscoveryDepth muito alto (causa transbordamento de token)
  • Usar rastreio para uma única página (use scrape em vez disso)

Exemplo de Prompt:

"Obtenha todas as postagens do blog dos dois primeiros níveis de exemplo.com/blog."

Exemplo de Uso:```json { "name": "firecrawl_crawl", "arguments": { "url": "https://example.com/blog/*", "maxDiscoveryDepth": 2, "limit": 100, "allowExternalLinks": false, "deduplicateSimilarURLs": true } }

root@kitploit:~
### 5. Verificar Status de Crawl (`firecrawl_check_crawl_status`)

Verifique o status e os resultados de um trabalho de crawl existente pelo ID.

**Retorna:**

- Status final do crawl e dados após a consulta interna, incluindo `id`, `status`, `completed`, `total`, `creditsUsed`, `expiresAt`, `next` e `data`. Use o `id` retornado com `firecrawl_check_crawl_status` se precisar verificar novamente o trabalho mais tarde.```json
{
  "name": "firecrawl_check_crawl_status",
  "arguments": {
    "id": "550e8400-e29b-41d4-a716-446655440000"
  }
}

Retorna:

  • A resposta inclui o status do trabalho de rastreamento:

6. Ferramenta de Análise (firecrawl_parse)

Analisa arquivos locais ou referências de upload hospedadas com o endpoint /v2/parse do Firecrawl.

Melhor para: PDFs, documentos do Word, planilhas, arquivos HTML e outros documentos que precisam de saída em markdown ou JSON estruturado. O MCP hospedado suporta um fluxo de upload-referência em duas etapas; leituras diretas de arquivos locais exigem um FIRECRAWL_API_URL auto-hospedado.

Não recomendado para: URLs remotas (use scrape), vários arquivos em uma única chamada (chame parse uma vez por arquivo) ou ações exclusivas do navegador, como capturas de tela e cliques.

Fluxo do MCP hospedado: O MCP hospedado não consegue ler o sistema de arquivos do chamador diretamente. Chame firecrawl_parse com filePath para receber um comando de upload de curta duração e nextToolCall, faça o upload do arquivo localmente e, em seguida, chame firecrawl_parse novamente com o uploadRef retornado. A geração da URL de upload hospedada requer autenticação do Firecrawl ou elegibilidade sem chave. No modo local npx firecrawl-mcp, a análise direta de arquivos atualmente requer FIRECRAWL_API_URL apontando para uma API Firecrawl auto-hospedada; um servidor local simples apenas com chave de API na nuvem não consegue ler e enviar arquivos por meio desta ferramenta.

Exemplo de uso:```json { "name": "firecrawl_parse", "arguments": { "filePath": "/absolute/path/to/document.pdf", "formats": ["markdown"], "parsers": ["pdf"], "zeroDataRetention": true } }

root@kitploit:~
**Retorna:** Conteúdo do documento analisado ou instruções de upload hospedado com um `nextToolCall`.

### 7. Ferramenta Extract (`firecrawl_extract`)

Extraia informações estruturadas de páginas da web usando capacidades de LLM. Suporta extração via IA em nuvem e LLM auto-hospedado.

**Melhor para:**

- Extrair dados estruturados específicos como preços, nomes, detalhes.

**Não recomendado para:**

- Quando você precisa do conteúdo completo de uma página (use scrape)
- Quando você não está procurando dados estruturados específicos

**Argumentos:**

- `urls`: Array de URLs para extrair informações
- `prompt`: Prompt personalizado para a extração com LLM
- `systemPrompt`: Prompt do sistema para guiar o LLM
- `schema`: Esquema JSON para extração de dados estruturados
- `allowExternalLinks`: Permitir extração de links externos
- `enableWebSearch`: Ativar pesquisa na web para contexto adicional
- `includeSubdomains`: Incluir subdomínios na extração

Ao usar uma instância auto-hospedada, a extração usará seu LLM configurado. Para a API em nuvem, usa o serviço gerenciado de LLM do Firecrawl.

**Exemplo de Prompt:**

> "Extraia o nome do produto, preço e descrição dessas páginas de produto."

**Exemplo de Uso:**```json
{
  "name": "firecrawl_extract",
  "arguments": {
    "urls": ["https://example.com/page1", "https://example.com/page2"],
    "prompt": "Extract product information including name, price, and description",
    "systemPrompt": "You are a helpful assistant that extracts product information",
    "schema": {
      "type": "object",
      "properties": {
        "name": { "type": "string" },
        "price": { "type": "number" },
        "description": { "type": "string" }
      },
      "required": ["name", "price"]
    },
    "allowExternalLinks": false,
    "enableWebSearch": false,
    "includeSubdomains": false
  }
}

Retorna:

  • Dados estruturados extraídos conforme definido pelo seu schema```json { "content": [ { "type": "text", "text": { "name": "Example Product", "price": 99.99, "description": "This is an example product description" } } ], "isError": false }
root@kitploit:~
### 8. Ferramenta de Agente (`firecrawl_agent`)

Agente de pesquisa web autônomo. Esta é uma camada de agente de IA separada que navega independentemente pela internet, busca informações, percorre páginas e extrai dados estruturados com base na sua consulta.

**Como funciona:**

O agente realiza pesquisas na web, segue links, lê páginas e coleta dados de forma autônoma. Isso é executado **assincronamente** - ele retorna um ID de job imediatamente, e você consulta `firecrawl_agent_status` para verificar quando estiver concluído e obter os resultados.

**Fluxo de trabalho assíncrono:**

1. Chame `firecrawl_agent` com seu prompt/esquema → retorna ID do job
2. Faça outro trabalho enquanto o agente pesquisa (pode levar minutos para consultas complexas)
3. Consulte `firecrawl_agent_status` com o ID do job para verificar o progresso
4. Quando o status for "completed", a resposta inclui os dados extraídos

**Melhor para:**

- Tarefas de pesquisa complexas onde você não sabe as URLs exatas
- Coleta de dados de múltiplas fontes
- Encontrar informações espalhadas pela web
- Tarefas onde você pode fazer outro trabalho enquanto espera pelos resultados

**Não recomendado para:**

- Raspagem simples de página única onde você sabe a URL (use scrape com formato JSON - mais rápido e barato)

**Argumentos:**

- `prompt`: Descrição em linguagem natural dos dados desejados (obrigatório, máximo de 10.000 caracteres)
- `urls`: Array opcional de URLs para focar o agente em páginas específicas
- `schema`: Esquema JSON opcional para saída estruturada

**Exemplo de Prompt:**

> "Encontre os fundadores da Firecrawl e suas formações"

**Exemplo de Uso (iniciar agente, depois consultar resultados):**```json
{
  "name": "firecrawl_agent",
  "arguments": {
    "prompt": "Find the top 5 AI startups founded in 2024 and their funding amounts",
    "schema": {
      "type": "object",
      "properties": {
        "startups": {
          "type": "array",
          "items": {
            "type": "object",
            "properties": {
              "name": { "type": "string" },
              "funding": { "type": "string" },
              "founded": { "type": "string" }
            }
          }
        }
      }
    }
  }
}

Em seguida, consulte com firecrawl_agent_status usando o ID do trabalho retornado.

Exemplo de Uso (com URLs - agente foca em páginas específicas):```json { "name": "firecrawl_agent", "arguments": { "urls": ["https://docs.firecrawl.dev", "https://firecrawl.dev/pricing"], "prompt": "Compare the features and pricing information from these pages" } }

root@kitploit:~
**Returns:**

- ID do trabalho para verificação de status. Use `firecrawl_agent_status` para consultar os resultados.

### 9. Verificar Status do Agente (`firecrawl_agent_status`)

Verifique o status de um job do agente e recupere os resultados quando concluído. Use isso para consultar os resultados após iniciar um agente.

**Padrão de consulta:** A pesquisa do agente pode levar minutos para consultas complexas. Consulte este endpoint periodicamente (por exemplo, a cada 10-30 segundos) até que o status seja "completed" ou "failed".```json
{
  "name": "firecrawl_agent_status",
  "arguments": {
    "id": "550e8400-e29b-41d4-a716-446655440000"
  }
}

Possible statuses:

  • processing: O agente ainda está pesquisando - verifique mais tarde
  • completed: Pesquisa concluída - a resposta inclui os dados extraídos
  • failed: Ocorreu um erro

10. Interact Tool (firecrawl_interact)

Interaja com uma nova URL ou com uma página que já foi aberta por firecrawl_scrape.

Melhor para: Clicar, digitar, navegar e extrair estado de páginas dinâmicas sem restaurar as ferramentas de navegador obsoletas.

Opções de uso:

  • Passe url para extrair e abrir uma página para interação em uma única chamada MCP.
  • Passe scrapeId para continuar interagindo com uma página já extraída.
  • Passe exatamente um de url ou scrapeId, mais prompt ou code.

Exemplo de uso:```json { "name": "firecrawl_interact", "arguments": { "url": "https://example.com", "prompt": "Click the pricing link and summarize the visible plans" } }

root@kitploit:~
**Retorna:** Resultado da interação e, para o modo URL, o `scrapeId` derivado para acompanhamento ou limpeza.

### 11. Ferramenta Parar Interação (`firecrawl_interact_stop`)

Pare uma sessão de interação para uma página raspada quando terminar de interagir.```json
{
  "name": "firecrawl_interact_stop",
  "arguments": {
    "scrapeId": "scrape-id-here"
  }
}

12. Ferramentas de Pesquisa (firecrawl_research_*)

Pesquise e inspecione artigos e repositórios do GitHub através das ferramentas MCP de pesquisa.

Ferramentas de pesquisa disponíveis:

  • firecrawl_research_search_papers: pesquisar artigos de pesquisa.
  • firecrawl_research_inspect_paper: inspecionar um artigo.
  • firecrawl_research_related_papers: encontrar artigos relacionados.
  • firecrawl_research_read_paper: ler o conteúdo de um artigo.
  • firecrawl_research_search_github: pesquisar repositórios do GitHub.

Melhor para: Revisão de literatura, consulta de artigos e fluxos de trabalho de descoberta de repositórios onde o agente precisa de uma superfície de pesquisa focada em vez de raspagem web genérica.

13. Ferramentas de Monitoramento (firecrawl_monitor_*)

Criar e gerenciar monitores de página recorrentes. Os monitores executam raspagens ou rastreios programados, comparam cada resultado com o último instantâneo retido e podem notificar por webhook ou e-mail.

Melhor para:

  • Observar uma ou algumas páginas ao longo do tempo
  • Alertar sobre mudanças significativas usando um objetivo em inglês simples
  • Rastrear o histórico de verificações e diferenças no nível da página

Padrão de criação recomendado:

Use page ou pages mais goal. O servidor MCP constrói a solicitação do monitor com um agendamento de 30 minutos e a API habilita a avaliação automática de mudanças significativas.

A avaliação de mudanças significativas é executada automaticamente quando goal é definido. Webhooks de página expõem isMeaningful e judgment em eventos monitor.page.

Escreva objetivos como instruções concisas de monitoramento de 2 a 3 frases. Diga o que deve acionar um alerta, preserve qualquer escopo que o usuário tenha fornecido e inclua exclusões específicas de intenção apenas quando óbvias a partir da solicitação. Ruído genérico, como espaços em branco, alterações apenas de formatação, IDs de solicitação, parâmetros de rastreamento, metadados genéricos e elementos de página não relacionados já são tratados pelo avaliador, portanto, não os repita em cada objetivo. Se o usuário for vago, mantenha o objetivo amplo; se ele solicitar monitoramento amplo ou "qualquer alteração", preserve isso. Se o usuário disser que não se importa com algo, inclua isso explicitamente.```json { "name": "firecrawl_monitor_create", "arguments": { "page": "https://example.com/pricing", "goal": "Alert when pricing, packaging, or launch messaging changes." } }

root@kitploit:~
**Várias páginas com webhooks:**```json
{
  "name": "firecrawl_monitor_create",
  "arguments": {
    "pages": ["https://example.com/pricing", "https://example.com/changelog"],
    "goal": "Alert when pricing, packaging, or launch messaging changes.",
    "webhookUrl": "https://example.com/webhooks/firecrawl"
  }
}

Solicitações avançadas de criação:

Passe body quando precisar de alvos de rastreamento, rastreamento de alterações JSON, retenção personalizada ou controle explícito de judgeEnabled.```json { "name": "firecrawl_monitor_create", "arguments": { "body": { "name": "Docs monitor", "schedule": { "text": "hourly", "timezone": "UTC" }, "goal": "Alert when docs pages add, remove, or materially change API behavior.", "targets": [{ "type": "crawl", "url": "https://example.com/docs" }] } } }

root@kitploit:~
**Outras ferramentas de monitor:**

- `firecrawl_monitor_list`: lista monitores.
- `firecrawl_monitor_get`: obtém um monitor.
- `firecrawl_monitor_update`: atualiza campos incluindo `goal`, `judgeEnabled`, `webhook`, e `notification`.
- `firecrawl_monitor_run`: aciona uma verificação agora.
- `firecrawl_monitor_delete`: exclui um monitor (destrutivo; chame apenas quando o usuário pretende removê-lo).
- `firecrawl_monitor_checks`: lista verificações, opcionalmente filtradas por status.
- `firecrawl_monitor_check`: obtém resultados no nível da página, incluindo `diff`, `snapshot`, `judgment.meaningful`, e `judgment.meaningfulChanges`.

## Sistema de Logging

O servidor inclui logging abrangente:

- Status e progresso das operações
- Métricas de desempenho
- Acompanhamento de limites de taxa
- Condições de erro

Exemplo de mensagens de log:```
[INFO] Firecrawl MCP Server initialized successfully
[INFO] Starting scrape for URL: https://example.com
[ERROR] Rate limit exceeded

Tratamento de Erros

O servidor oferece tratamento robusto de erros:

  • Erros de limite de taxa da API exibidos ao cliente MCP
  • Mensagens de erro detalhadas
  • Resiliência de rede

Exemplo de resposta de erro:```json { "content": [ { "type": "text", "text": "Error: Rate limit exceeded" } ], "isError": true }

root@kitploit:~
## Desenvolvimento```bash
# Install dependencies
npm install

# Build
npm run build

# Run tests
npm test

Contribuindo

  1. Faça um fork do repositório
  2. Crie sua branch de funcionalidade
  3. Execute os testes: npm test
  4. Envie um pull request

Agradecimentos aos contribuidores

Agradecimentos a @vrknetha, @cawstudios pela implementação inicial!

Agradecimentos ao MCP.so e Klavis AI por hospedar e a @gstarwd, @xiangkaiz e @zihaolin96 por integrar nosso servidor.

Licença

Licença MIT - consulte o arquivo LICENSE para detalhes

Baixar ferramenta