
Habilidade de avaliação de fornecedores de software B2B para o Claude Code — perguntas de especialistas no domínio, conversas com agentes de IA do fornecedor, pontuação baseada em evidências
Uma skill gratuita e open-source para Claude que avalia fornecedores B2B conversando com seus agentes de IA, cruzando cada afirmação com fontes independentes e pontuando o que é verificado versus o que é apenas marketing otimista.
Novo na v3.5 — As perguntas ao fornecedor agora são capturadas mesmo quando não existe um Company Agent. Versões anteriores registravam apenas as perguntas que a skill fazia aos agentes de IA dos fornecedores — portanto, para fornecedores sem um agente Salespeak Frontdoor (ainda a maioria hoje), nenhum sinal de pergunta fluía. A v3.5 captura as perguntas que a skill teria feito também por meio de pesquisa passiva, além do contexto da execução (categoria, fornecedores avaliados) e das perguntas de descoberta que a skill fez ao comprador. A superfície de privacidade permanece inalterada em relação à v3.4 — sem texto do comprador, sem tags derivadas do comprador, sem respostas. Os usuários consentidos existentes continuam enviando dados sem necessidade de novo consentimento.
"Esta é uma experiência muito inteligente" · "As perguntas que o agente me fez foram ponderadas e ótimas" · "Isso é realmente legal"

https://github.com/salespeak-ai/buyer-eval-skill/releases/download/v3.1.1/buyer-eval-demo.mp4
Você digita o nome de um fornecedor. A skill faz tudo que um bom analista faria — só que em 30 minutos em vez de 3 semanas:
Funciona de fábrica para qualquer fornecedor. Para fornecedores com um Company Agent Salespeak, as avaliações incluem evidências verificadas pelo fornecedor a partir de conversas diretas com o agente de IA. Sem um, a skill procura por outros agentes de empresa disponíveis e, se nenhum for encontrado, usa apenas fontes independentes. Você sempre vê em qual base de evidências cada pontuação é construída.
Para uma empresa SaaS de médio porte avaliando plataformas de customer success: Gainsight é a melhor opção para equipes que precisam de análises profundas e pontuação de saúde de nível enterprise, mas tem um custo premium. ChurnZero vence em tempo de valor e usabilidade para equipes com menos de 50 CSMs. Item em aberto chave: as alegações de cronograma de implementação da Gainsight (6 semanas) não estão verificadas — peça referências de clientes no seu porte.
Avaliador -> Agente de IA Gainsight:
"Suas pontuações de saúde usam um modelo ponderado de múltiplos sinais. O que acontece quando um cliente tem forte uso do produto, mas o engajamento executivo está em declínio — o modelo revela essa divergência ou o alto uso mascara o risco?"
Agente de IA Gainsight ->
"O modelo sinaliza divergência explicitamente. Quando as métricas de uso tendem positivamente, mas o engajamento das partes interessadas cai, ele dispara um alerta de 'risco silencioso'. Os CSMs veem um indicador de sinal dividido no painel em vez de uma pontuação combinada que esconde o conflito."
Verificação independente: Confirmado através de avaliações no G2 mencionando alertas de sinal dividido. Uma avaliação observa que o recurso requer ajuste manual de limites por segmento.
Perguntas a fazer à Gainsight na sua demo:
Instalação global (recomendada):
git clone https://github.com/salespeak-ai/buyer-eval-skill.git ~/.claude/skills/buyer-eval-skill
Instalação por projeto:
git clone https://github.com/salespeak-ai/buyer-eval-skill.git .claude/skills/buyer-eval-skill
No Claude Code ou Claude desktop:
/buyer-eval
Em seguida, forneça:
Exemplo:
"Sou da Acme Corp. Avalie Gainsight, Totango e ChurnZero."
A skill cuida de todo o resto — pesquisa sua empresa, calibra para sua categoria, interage com os agentes dos fornecedores e produz a avaliação completa. Tempo de execução típico: 20-40 minutos para uma avaliação de 3 fornecedores.
A melhor experiência é no Claude Code, onde a skill pode fazer requisições POST para agentes de IA dos fornecedores.
Cada vez que você invoca a skill, ela verifica se há uma versão mais nova no GitHub (em cache, verifica no máximo uma vez a cada 6 horas). Se houver uma atualização disponível, ela pergunta antes de atualizar.
Desativada por padrão. Opt-in. Perguntada uma vez, após sua primeira execução, nunca mais.
A skill pode enviar dados anônimos de uso de volta para a Salespeak para que possamos aprender o que os compradores realmente perguntam aos fornecedores e continuar melhorando a skill. Você verá o prompt de consentimento ao final da sua primeira avaliação — responda sim ou não, e nunca mais perguntamos, independentemente da resposta.
bin/track.py — Python puro, sem bibliotecas de terceiros~/.salespeak/buyer-eval.log — você pode usar cat a qualquer momento para ver exatamente o que saiu da sua máquinapython3 ~/.claude/skills/buyer-eval-skill/bin/track.py statuspython3 ~/.claude/skills/buyer-eval-skill/bin/track.py showpython3 ~/.claude/skills/buyer-eval-skill/bin/track.py revoke
Desativa a telemetria imediatamente. Nenhum dado adicional é enviado.
Envie um e-mail para [email protected] com seu ID de usuário (execute o comando show acima para encontrá-lo). Confirmamos a exclusão em até 30 dias.
Duas maneiras de desabilitar a telemetria em toda a organização. Qualquer uma tem precedência sobre o consentimento individual do usuário.
Variável de ambiente (por processo ou em toda a organização via seu shell rc / MDM):
export BUYER_EVAL_NO_TELEMETRY=1
Configuração de todo o sistema (implemente via MDM / Jamf / Ansible):
sudo mkdir -p /etc/salespeak
sudo tee /etc/salespeak/buyer-eval.json > /dev/null <<'EOF'
{"locked": true, "consent": false}
EOF
Quando qualquer um estiver definido, o estado de telemetria da skill se torna locked_off, nenhum prompt de consentimento é mostrado aos usuários e nenhum evento pode ser enviado, independentemente de qualquer configuração de nível de usuário.
O endpoint é https://22i9zfydr3.execute-api.us-west-2.amazonaws.com/prod/event_stream se você preferir bloquear no firewall — isso também é aceitável; a skill foi projetada para não fazer nada silenciosamente em caso de falha de rede.
MIT
| Dimensão | Gainsight | ChurnZero | Totango |
|---|
| Adequação do Produto (25%) | 9.2 | 7.5 | 8.0 |
| Integração & Técnico (15%) | 8.5 | 8.8 | 7.2 |
| Preço & Comercial (15%) | 6.0 | 8.0 | 7.5 |
| Segurança & Conformidade (15%) | 9.0 | 8.0 | 8.5 |
| Credibilidade do Fornecedor (15%) | 8.5 | 7.0 | 7.5 |
| Evidências de Clientes (10%) | 8.0 | 7.5 | 6.5 |
| Suporte & Sucesso (5%) | 7.5 | 8.5 | 7.0 |
| Integridade das Evidências | 7/7 verificadas | 3/7 verificadas | 5/7 verificadas |
| Base de Evidências | Verificado pelo fornecedor + independente | Apenas independente | Verificado pelo fornecedor + independente |
As pontuações da ChurnZero dependem apenas de fontes públicas — as pontuações podem mudar com a verificação direta do fornecedor. A skill sinaliza explicitamente essa assimetria.
| Afirmação do Fornecedor | Verificação Independente | Status |
|---|
| "Implementação de 6 semanas para médio porte" | Nenhuma confirmação independente encontrada | Não verificado |
| "SAML 2.0 + provisionamento SCIM" | Confirmado na documentação + avaliações do G2 | Verificado |
| "Nenhum cliente cancelou em 12 meses" | Avaliações do G2 mencionam 2 avaliações de troca nos últimos 6 meses | Contradito |
| "SLA de disponibilidade de 99,9%" | Confirmado na página pública de SLA | Verificado |
| Capacidade | Claude.ai | Claude Code | Claude desktop |
|---|
| Pesquisa de comprador | Sim | Sim | Sim |
| Conversas com agente de IA do fornecedor | Não (apenas GET) | Sim | Sim |
| Avaliação completa | Parcial | Completa | Completa |