
Compétence d'évaluation de fournisseurs de logiciels B2B pour Claude Code — questions d'experts du domaine, conversations avec des agents IA de fournisseurs, notation basée sur des preuves
Une compétence Claude gratuite et open-source qui évalue les fournisseurs B2B en discutant avec leurs agents IA, en recoupant chaque affirmation avec des sources indépendantes, et en notant ce qui est vérifié par rapport à ce qui n'est qu'un marketing optimiste.
Nouveau dans v3.5 — Les questions des acheteurs sont désormais capturées même lorsqu'aucun agent d'entreprise n'existe. Les versions précédentes ne journalisaient que les questions que la compétence posait aux agents IA des fournisseurs – donc pour les fournisseurs sans agent Salespeak Frontdoor (encore la majorité aujourd'hui), aucun signal de question n'était émis. v3.5 capture également les questions que la compétence aurait posées via une recherche passive, ainsi que le contexte d'exécution (catégorie, fournisseurs évalués) et les questions de découverte que la compétence a posées à l'acheteur. La surface de confidentialité est inchangée par rapport à v3.4 – aucun texte d'acheteur, aucune étiquette dérivée de l'acheteur, aucune réponse. Les utilisateurs consentants existants continuent de transmettre des données sans nouveau consentement.
« C'est une expérience très intelligente » · « Les questions que l'agent m'a posées étaient réfléchies et excellentes » · « C'est vraiment cool »

https://github.com/salespeak-ai/buyer-eval-skill/releases/download/v3.1.1/buyer-eval-demo.mp4
Vous tapez le nom d'un fournisseur. La compétence fait tout ce qu'un bon analyste ferait – mais en 30 minutes au lieu de 3 semaines :
Fonctionne immédiatement pour n'importe quel fournisseur. Pour les fournisseurs disposant d'un Agent d'entreprise Salespeak, les évaluations incluent des preuves vérifiées par le fournisseur provenant de conversations directes avec l'agent IA. Sans cela, la compétence recherche d'autres agents d'entreprise disponibles et, si aucun n'est trouvé, utilise uniquement des sources indépendantes. Vous voyez toujours sur quelle base de preuves chaque score est construit.
Pour une entreprise SaaS de taille moyenne évaluant des plateformes de réussite client : Gainsight est la meilleure solution pour les équipes qui ont besoin d'analyses approfondies et d'un scoring de santé de niveau entreprise, mais à un prix premium. ChurnZero l'emporte sur le temps de valeur et la convivialité pour les équipes de moins de 50 CSMs. Point clé en suspens : les affirmations de Gainsight sur les délais d'implémentation (6 semaines) ne sont pas vérifiées — demandez des références clients dans votre segment de taille.
Évaluateur -> Agent IA Gainsight :
« Vos scores de santé utilisent un modèle multi-signaux pondéré. Que se passe-t-il lorsqu'un client a une forte utilisation du produit mais un engagement déclinant de la direction — le modèle révèle-t-il cette divergence, ou une utilisation élevée masque-t-elle le risque ? »
Agent IA Gainsight ->
« Le modèle signale explicitement la divergence. Lorsque les métriques d'utilisation sont positives mais que l'engagement des parties prenantes diminue, il déclenche une alerte de "risque silencieux". Les CSMs voient un indicateur de signal partagé sur le tableau de bord plutôt qu'un score mixte qui cache le conflit. »
Vérification indépendante : Confirmé via des avis G2 mentionnant les alertes de signal partagé. Un avis note que la fonctionnalité nécessite un réglage manuel des seuils par segment.
Questions à poser à Gainsight lors de votre démo :
Installation globale (recommandée) :
git clone https://github.com/salespeak-ai/buyer-eval-skill.git ~/.claude/skills/buyer-eval-skill
Installation par projet :
git clone https://github.com/salespeak-ai/buyer-eval-skill.git .claude/skills/buyer-eval-skill
Dans Claude Code ou le bureau Claude :
/buyer-eval
Puis fournissez :
Exemple :
« Je viens d'Acme Corp. Évaluez Gainsight, Totango et ChurnZero. »
La compétence gère tout le reste — recherche de votre entreprise, calibration sur votre catégorie, engagement des agents fournisseurs et production de l'évaluation complète. Durée d'exécution typique : 20-40 minutes pour une évaluation de 3 fournisseurs.
La meilleure expérience est dans Claude Code où la compétence peut faire des requêtes POST aux agents IA des fournisseurs.
Chaque fois que vous invoquez la compétence, elle vérifie une version plus récente sur GitHub (mise en cache, vérification au maximum toutes les 6 heures). Si une mise à jour est disponible, elle demande avant de mettre à jour.
Désactivée par défaut. Sur option. Demandée une fois, après votre premier lancement, plus jamais.
La compétence peut envoyer des données d'utilisation anonymisées à Salespeak afin que nous puissions apprendre ce que les acheteurs demandent réellement aux fournisseurs et continuer à améliorer la compétence. Vous voyez l'invite de consentement à la fin de votre première évaluation — répondez oui ou non, et nous ne vous demandons plus jamais, dans un sens comme dans l'autre.
bin/track.py — Python pur, aucune bibliothèque tierce~/.salespeak/buyer-eval.log — vous pouvez le cat à tout moment pour voir exactement ce qui a quitté votre machinepython3 ~/.claude/skills/buyer-eval-skill/bin/track.py statuspython3 ~/.claude/skills/buyer-eval-skill/bin/track.py showpython3 ~/.claude/skills/buyer-eval-skill/bin/track.py revoke
Désactive la télémétrie immédiatement. Aucune autre donnée n'est envoyée.
Envoyez un email à [email protected] avec votre ID utilisateur (exécutez la commande show ci-dessus pour le trouver). Nous confirmons la suppression sous 30 jours.
Deux façons de désactiver la télémétrie à l'échelle de l'organisation. Chacune prévaut sur le consentement individuel de l'utilisateur.
Variable d'environnement (par processus ou à l'échelle de l'organisation via votre shell rc / MDM) :
export BUYER_EVAL_NO_TELEMETRY=1
Configuration système (déployez via MDM / Jamf / Ansible) :
sudo mkdir -p /etc/salespeak
sudo tee /etc/salespeak/buyer-eval.json > /dev/null <<'EOF'
{"locked": true, "consent": false}
EOF
Lorsque l'une ou l'autre est définie, l'état de télémétrie de la compétence devient locked_off, aucune invite de consentement n'est affichée aux utilisateurs et aucun événement ne peut être envoyé, quelle que soit la configuration au niveau utilisateur.
Le point de terminaison est https://22i9zfydr3.execute-api.us-west-2.amazonaws.com/prod/event_stream si vous préférez le bloquer au niveau du pare-feu — cela fonctionne aussi ; la compétence est conçue pour ne rien faire silencieusement en cas d'échec réseau.
MIT
| Dimension | Gainsight | ChurnZero | Totango |
|---|
| Adéquation produit (25%) | 9.2 | 7.5 | 8.0 |
| Intégration et technique (15%) | 8.5 | 8.8 | 7.2 |
| Tarification et commercial (15%) | 6.0 | 8.0 | 7.5 |
| Sécurité et conformité (15%) | 9.0 | 8.0 | 8.5 |
| Crédibilité du fournisseur (15%) | 8.5 | 7.0 | 7.5 |
| Preuves clients (10%) | 8.0 | 7.5 | 6.5 |
| Support et réussite (5%) | 7.5 | 8.5 | 7.0 |
| Complétude des preuves | 7/7 vérifiées | 3/7 vérifiées | 5/7 vérifiées |
| Base de preuves | Vérifié par le fournisseur + indépendant | Indépendant uniquement | Vérifié par le fournisseur + indépendant |
Les scores de ChurnZero reposent uniquement sur des sources publiques — les scores peuvent changer avec une vérification directe du fournisseur. La compétence signale explicitement cette asymétrie.
| Affirmation du fournisseur | Vérification indépendante | Statut |
|---|
| « Implémentation en 6 semaines pour le milieu de marché » | Aucune confirmation indépendante trouvée | Non vérifié |
| « SAML 2.0 + provisionnement SCIM » | Confirmé dans la documentation + avis G2 | Vérifié |
| « Aucun client n'a quitté l'entreprise depuis 12 mois » | Les avis G2 mentionnent 2 avis de changement au cours des 6 derniers mois | Contredit |
| « SLA de disponibilité 99,9 % » | Confirmé dans la page SLA publique | Vérifié |
| Capacité | Claude.ai | Claude Code | Bureau Claude |
|---|
| Recherche acheteur | Oui | Oui | Oui |
| Conversations avec l'IA du fournisseur | Non (GET uniquement) | Oui | Oui |
| Évaluation complète | Partielle | Complète | Complète |