
Habilidad de evaluación de proveedores de software B2B para Claude Code — preguntas de expertos en el dominio, conversaciones con agentes de IA del proveedor, puntuación basada en evidencia
Un skill gratuito y de código abierto para Claude que evalúa proveedores B2B conversando con sus agentes de IA, contrastando cada afirmación con fuentes independientes y puntuando lo que está verificado frente a lo que es solo marketing optimista.
Nuevo en v3.5 — Las preguntas del proveedor ahora se capturan incluso cuando no existe un Agente de Empresa. Las versiones anteriores solo registraban las preguntas que el skill hacía a los agentes de IA de los proveedores, por lo que para proveedores sin un agente de Salespeak Frontdoor (aún la mayoría hoy), no fluía ninguna señal de pregunta. v3.5 captura las preguntas que el skill habría hecho también mediante investigación pasiva, además del contexto de la ejecución (categoría, proveedores evaluados) y las preguntas de descubrimiento que el skill hizo al comprador. La superficie de privacidad no cambia respecto a v3.4 — sin texto del comprador, sin etiquetas derivadas del comprador, sin respuestas. Los usuarios que ya consintieron siguen fluyendo datos sin necesidad de nuevo consentimiento.
"Esta es una experiencia muy inteligente" · "Las preguntas que me hizo el agente fueron reflexivas y excelentes" · "Esto es realmente genial"

https://github.com/salespeak-ai/buyer-eval-skill/releases/download/v3.1.1/buyer-eval-demo.mp4
Escribe el nombre de un proveedor. El skill hace todo lo que haría un gran analista, excepto que en 30 minutos en lugar de 3 semanas:
Funciona de inmediato para cualquier proveedor. Para proveedores con un Agente de Empresa de Salespeak, las evaluaciones incluyen evidencia verificada por el proveedor proveniente de conversaciones directas con el agente de IA. Sin uno, el skill busca otros agentes de empresa disponibles y, si no encuentra ninguno, utiliza solo fuentes independientes. Siempre ves en qué base de evidencia se sustenta cada puntuación.
Para una empresa SaaS de mercado medio que evalúa plataformas de éxito del cliente: Gainsight es la opción más adecuada para equipos que necesitan análisis profundos y puntuación de salud de nivel empresarial, pero tiene un precio superior. ChurnZero gana en tiempo de valor y usabilidad para equipos con menos de 50 CSMs. Punto abierto clave: las afirmaciones de Gainsight sobre el cronograma de implementación (6 semanas) no están verificadas — pide referencias de clientes en tu rango de tamaño.
Evaluador -> Agente de IA de Gainsight:
"Sus puntuaciones de salud utilizan un modelo ponderado de múltiples señales. ¿Qué sucede cuando un cliente tiene un uso fuerte del producto pero una participación ejecutiva decreciente? ¿El modelo saca a la luz esa divergencia, o el alto uso enmascara el riesgo?"
Agente de IA de Gainsight ->
"El modelo señala la divergencia explícitamente. Cuando las métricas de uso son positivas pero el compromiso de las partes interesadas disminuye, se activa una alerta de 'riesgo silencioso'. Los CSMs ven un indicador de señal dividida en el panel en lugar de una puntuación combinada que oculta el conflicto."
Verificación independiente: Confirmado a través de reseñas de G2 que mencionan alertas de señal dividida. Una reseña señala que la función requiere ajuste manual de umbrales por segmento.
Preguntas para hacer a Gainsight en tu demo:
Instalación global (recomendada):
git clone https://github.com/salespeak-ai/buyer-eval-skill.git ~/.claude/skills/buyer-eval-skill
Instalación por proyecto:
git clone https://github.com/salespeak-ai/buyer-eval-skill.git .claude/skills/buyer-eval-skill
En Claude Code o Claude desktop:
/buyer-eval
Luego proporciona:
Ejemplo:
"Soy de Acme Corp. Evalúa Gainsight, Totango y ChurnZero."
El skill maneja todo desde ahí — investigar tu empresa, calibrarse a tu categoría, interactuar con agentes de proveedores y producir la evaluación completa. Tiempo de ejecución típico: 20-40 minutos para una evaluación de 3 proveedores.
La mejor experiencia es en Claude Code, donde el skill puede hacer solicitudes POST a los agentes de IA de los proveedores.
Cada vez que invocas el skill, verifica si hay una versión más reciente en GitHub (almacenado en caché, verifica como máximo cada 6 horas). Si hay una actualización disponible, pregunta antes de actualizar.
Desactivada por defecto. Voluntaria. Se pregunta una vez, después de tu primer uso, y nunca más.
El skill puede enviar datos de uso anónimos de vuelta a Salespeak para que podamos aprender qué preguntan realmente los compradores a los proveedores y seguir mejorando el skill. Verás la solicitud de consentimiento al final de tu primera evaluación — responde sí o no, y nunca volveremos a preguntar en ningún caso.
bin/track.py — Python simple, sin bibliotecas de terceros~/.salespeak/buyer-eval.log — puedes hacer cat en cualquier momento para ver exactamente qué salió de tu máquinapython3 ~/.claude/skills/buyer-eval-skill/bin/track.py statuspython3 ~/.claude/skills/buyer-eval-skill/bin/track.py showpython3 ~/.claude/skills/buyer-eval-skill/bin/track.py revoke
Desactiva la telemetría inmediatamente. No se envía más datos.
Envía un correo a [email protected] con tu ID de usuario (ejecuta el comando show de arriba para encontrarlo). Confirmamos la eliminación en un plazo de 30 días.
Dos formas de desactivar la telemetría a nivel de organización. Cualquiera de ellas tiene prioridad sobre el consentimiento individual del usuario.
Variable de entorno (por proceso o a nivel de organización mediante tu shell rc / MDM):
export BUYER_EVAL_NO_TELEMETRY=1
Configuración de todo el sistema (implementar mediante MDM / Jamf / Ansible):
sudo mkdir -p /etc/salespeak
sudo tee /etc/salespeak/buyer-eval.json > /dev/null <<'EOF'
{"locked": true, "consent": false}
EOF
Cuando se establece cualquiera de estas, el estado de telemetría del skill se convierte en locked_off, no se muestra ninguna solicitud de consentimiento a los usuarios y no se puede enviar ningún evento, independientemente de cualquier configuración a nivel de usuario.
El endpoint es https://22i9zfydr3.execute-api.us-west-2.amazonaws.com/prod/event_stream si prefieres bloquearlo en el firewall — también está bien; el skill está diseñado para no hacer nada silenciosamente en caso de fallo de red.
MIT
| Dimensión | Gainsight | ChurnZero | Totango |
|---|
| Ajuste del producto (25%) | 9.2 | 7.5 | 8.0 |
| Integración y técnica (15%) | 8.5 | 8.8 | 7.2 |
| Precio y comercial (15%) | 6.0 | 8.0 | 7.5 |
| Seguridad y cumplimiento (15%) | 9.0 | 8.0 | 8.5 |
| Credibilidad del proveedor (15%) | 8.5 | 7.0 | 7.5 |
| Evidencia del cliente (10%) | 8.0 | 7.5 | 6.5 |
| Soporte y éxito (5%) | 7.5 | 8.5 | 7.0 |
| Integridad de la evidencia | 7/7 verificada | 3/7 verificada | 5/7 verificada |
| Base de evidencia | Verificada por el proveedor + independiente | Solo independiente | Verificada por el proveedor + independiente |
Las puntuaciones de ChurnZero se basan únicamente en fuentes públicas; las puntuaciones pueden cambiar con la verificación directa del proveedor. El skill destaca explícitamente esta asimetría.
| Afirmación del proveedor | Verificación independiente | Estado |
|---|
| "Implementación de 6 semanas para mercado medio" | No se encontró confirmación independiente | No verificado |
| "SAML 2.0 + aprovisionamiento SCIM" | Confirmado en documentación + reseñas de G2 | Verificado |
| "Ningún cliente ha cancelado en 12 meses" | Reseñas de G2 mencionan 2 cambios en los últimos 6 meses | Contradicho |
| "SLA de disponibilidad del 99.9%" | Confirmado en página pública de SLA | Verificado |
| Capacidad | Claude.ai | Claude Code | Claude desktop |
|---|
| Investigación del comprador | Sí | Sí | Sí |
| Conversaciones con agentes de IA de proveedores | No (solo GET) | Sí | Sí |
| Evaluación completa | Parcial | Completa | Completa |