
B2B-Softwareanbieter-Bewertungsfähigkeit für Claude Code — Fragen von Fachexperten, Gespräche mit KI-Agenten von Anbietern, evidenzbasierte Bewertung
Ein kostenloses, quelloffenes Claude-Skill, das B2B-Anbieter bewertet, indem es mit deren KI-Agenten spricht, jede Behauptung mit unabhängigen Quellen abgleicht und bewertet, was verifiziert ist und was nur optimistisches Marketing ist.
Neu in v3.5 – Anbieterfragen werden jetzt auch erfasst, wenn kein Unternehmens-Agent existiert. Frühere Versionen protokollierten nur die Fragen, die das Skill an die KI-Agenten der Anbieter stellte – bei Anbietern ohne Salespeak Frontdoor-Agent (heute noch die meisten) floss also kein Fragensignal. v3.5 erfasst die Fragen, die das Skill gestellt hätte, auch durch passive Recherche, sowie den Ausführungskontext (Kategorie, bewertete Anbieter) und die Entdeckungsfragen, die das Skill dem Käufer gestellt hat. Der Datenschutz ist gegenüber v3.4 unverändert – kein Käufertext, keine vom Käufer abgeleiteten Tags, keine Antworten. Bestehende zustimmende Nutzer senden weiterhin Daten ohne erneute Zustimmung.
„Das ist eine sehr intelligente Erfahrung“ · „Die Fragen, die der Agent mir gestellt hat, waren durchdacht und großartig“ · „Das ist wirklich cool“

https://github.com/salespeak-ai/buyer-eval-skill/releases/download/v3.1.1/buyer-eval-demo.mp4
Du gibst den Namen eines Anbieters ein. Das Skill erledigt alles, was ein guter Analyst tun würde – nur in 30 Minuten statt 3 Wochen:
Funktioniert sofort für jeden Anbieter. Bei Anbietern mit einem Salespeak-Unternehmens-Agenten enthalten Bewertungen vom Anbieter verifizierte Belege aus direkten KI-Agenten-Gesprächen. Ohne einen solchen sucht das Skill nach anderen verfügbaren Unternehmens-Agenten und, falls keine gefunden werden, verwendet es nur unabhängige Quellen. Du siehst immer, auf welcher Belegbasis jede Bewertung beruht.
Für ein mittelständisches SaaS-Unternehmen, das Customer-Success-Plattformen evaluiert: Gainsight ist die beste Wahl für Teams, die tiefgehende Analysen und unternehmensweite Gesundheitsbewertungen benötigen, aber zu einem Premiumpreis. ChurnZero punktet mit Time-to-Value und Benutzerfreundlichkeit für Teams unter 50 CSMs. Wichtigster offener Punkt: Gainsights Behauptungen zur Implementierungsdauer (6 Wochen) sind nicht verifiziert – bitte um Kundenreferenzen in deiner Größenklasse.
Bewerter -> Gainsight KI-Agent:
„Ihre Gesundheitsbewertungen verwenden ein gewichtetes Multi-Signal-Modell. Was passiert, wenn ein Kunde eine starke Produktnutzung, aber sinkendes Engagement der Führungskräfte hat – deckt das Modell diese Divergenz auf oder kaschiert die hohe Nutzung das Risiko?“
Gainsight KI-Agent ->
„Das Modell kennzeichnet die Divergenz explizit. Wenn Nutzungsmetriken positiv sind, aber das Stakeholder-Engagement sinkt, wird eine ‚Stille-Risiko‘-Warnung ausgelöst. CSMs sehen auf dem Dashboard einen Split-Signal-Indikator anstelle eines gemischten Scores, der den Konflikt verbirgt.“
Unabhängige Verifizierung: Bestätigt durch G2-Bewertungen, die Split-Signal-Warnungen erwähnen. Eine Bewertung weist darauf hin, dass die Funktion eine manuelle Schwellenwertanpassung pro Segment erfordert.
Fragen, die du Gainsight in deiner Demo stellen solltest:
Globale Installation (empfohlen):
git clone https://github.com/salespeak-ai/buyer-eval-skill.git ~/.claude/skills/buyer-eval-skill
Projektbezogene Installation:
git clone https://github.com/salespeak-ai/buyer-eval-skill.git .claude/skills/buyer-eval-skill
In Claude Code oder Claude Desktop:
/buyer-eval
Dann gib an:
Beispiel:
„Ich bin von der Acme Corp. Bewerte Gainsight, Totango und ChurnZero.“
Das Skill kümmert sich um alles Weitere – Recherche zu deinem Unternehmen, Kalibrierung auf deine Kategorie, Interaktion mit Anbieter-Agenten und Erstellung der vollständigen Bewertung. Typische Laufzeit: 20–40 Minuten für eine 3-Anbieter-Bewertung.
Die beste Erfahrung bietet Claude Code, wo das Skill POST-Anfragen an die KI-Agenten der Anbieter stellen kann.
Jedes Mal, wenn du das Skill aufrufst, prüft es auf GitHub nach einer neueren Version (zwischengespeichert, maximal alle 6 Stunden). Wenn ein Update verfügbar ist, fragt es, bevor es aktualisiert.
Standardmäßig deaktiviert. Opt-in. Einmalig nach deinem ersten Durchlauf gefragt, danach nie wieder.
Das Skill kann anonymisierte Nutzungsdaten an Salespeak senden, damit wir lernen, was Käufer Anbieter tatsächlich fragen, und das Skill kontinuierlich verbessern können. Du siehst die Zustimmungsaufforderung am Ende deiner ersten Bewertung – antworte mit Ja oder Nein, und wir fragen nie wieder, egal wie du antwortest.
bin/track.py – reines Python, keine Drittanbieter-Bibliotheken~/.salespeak/buyer-eval.log geschrieben – du kannst es jederzeit mit cat ansehen, um genau zu sehen, was deinen Rechner verlassen hatpython3 ~/.claude/skills/buyer-eval-skill/bin/track.py statuspython3 ~/.claude/skills/buyer-eval-skill/bin/track.py showpython3 ~/.claude/skills/buyer-eval-skill/bin/track.py revoke
Deaktiviert die Telemetrie sofort. Es werden keine weiteren Daten gesendet.
Sende eine E-Mail an [email protected] mit deiner Benutzer-ID (führe den obigen Befehl show aus, um sie zu finden). Wir bestätigen die Löschung innerhalb von 30 Tagen.
Zwei Möglichkeiten, die Telemetrie organisationsweit zu deaktivieren. Beide haben Vorrang vor der individuellen Benutzereinwilligung.
Umgebungsvariable (prozessweit oder organisationsweit über Shell rc / MDM):
export BUYER_EVAL_NO_TELEMETRY=1
Systemweite Konfiguration (über MDM / Jamf / Ansible bereitstellen):
sudo mkdir -p /etc/salespeak
sudo tee /etc/salespeak/buyer-eval.json > /dev/null <<'EOF'
{"locked": true, "consent": false}
EOF
Wenn eine dieser Optionen gesetzt ist, wird der Telemetriestatus des Skills zu locked_off, es wird kein Zustimmungsdialog angezeigt und es können unabhängig von einer benutzerseitigen Konfiguration keine Ereignisse gesendet werden.
Der Endpunkt ist https://22i9zfydr3.execute-api.us-west-2.amazonaws.com/prod/event_stream, falls du ihn lieber auf der Firewall blockieren möchtest – auch das ist in Ordnung; das Skill ist so ausgelegt, dass es bei Netzwerkfehlern stillschweigend nichts tut.
MIT
| Dimension | Gainsight | ChurnZero | Totango |
|---|
| Produktfit (25%) | 9.2 | 7.5 | 8.0 |
| Integration & Technik (15%) | 8.5 | 8.8 | 7.2 |
| Preisgestaltung & Kommerziell (15%) | 6.0 | 8.0 | 7.5 |
| Sicherheit & Compliance (15%) | 9.0 | 8.0 | 8.5 |
| Anbieter-Glaubwürdigkeit (15%) | 8.5 | 7.0 | 7.5 |
| Kundenbelege (10%) | 8.0 | 7.5 | 6.5 |
| Support & Erfolg (5%) | 7.5 | 8.5 | 7.0 |
| Beleg-Vollständigkeit | 7/7 verifiziert | 3/7 verifiziert | 5/7 verifiziert |
| Belegbasis | Vom Anbieter verifiziert + unabhängig | Nur unabhängig | Vom Anbieter verifiziert + unabhängig |
Die Bewertungen von ChurnZero basieren ausschließlich auf öffentlichen Quellen – die Werte können sich mit direkter Anbieterverifizierung verschieben. Das Skill weist explizit auf diese Asymmetrie hin.
| Behauptung des Anbieters | Unabhängige Verifizierung | Status |
|---|
| „6-wöchige Implementierung für den Mittelstand“ | Keine unabhängige Bestätigung gefunden | Nicht verifiziert |
| „SAML 2.0 + SCIM-Provisionierung“ | In Dokumentation + G2-Bewertungen bestätigt | Verifiziert |
| „Kein Kunde ist in 12 Monaten abgesprungen“ | G2-Bewertungen erwähnen 2 Wechsel in den letzten 6 Monaten | Widerlegt |
| „99,9 % Verfügbarkeits-SLA“ | In öffentlicher SLA-Seite bestätigt | Verifiziert |
| Fähigkeit | Claude.ai | Claude Code | Claude Desktop |
|---|
| Käuferrecherche | Ja | Ja | Ja |
| Gespräche mit KI-Agenten des Anbieters | Nein (nur GET) | Ja | Ja |
| Vollständige Bewertung | Teilweise | Vollständig | Vollständig |