2024 war das Jahr der Demos. 2025 war das Jahr der Piloten. 2026 ist das erste Jahr, in dem jemand nach der Rechnung fragt — und diese Frage ist gesund. Unten stehen sieben Arten, wie diese Rechnung negativ ausfällt.
Ein Katalog, nach Symptomen
Keine dieser Fallen trägt ein Schild. Alle lassen sich aber daran erkennen, was nach einigen Wochen im Team sichtbar wird:
| Falle | Woran Sie sie erkennen |
|---|---|
| Werkzeug statt Problem | Die Einführung begann mit einem Produktnamen, nicht mit einer Zahl, die besser werden soll |
| Prüfung teurer als die Arbeit | Die Vertriebskraft liest den generierten Text länger, als sie selbst schreiben würde |
| Müll am Eingang | Das Modell bekommt ein lückenhaftes CRM und produziert glaubwürdig klingende Unwahrheiten |
| Automatisierung eines schlechten Prozesses | Sie haben einen Schritt beschleunigt, den man hätte streichen sollen |
| Aufnahmen als Kontrollinstrument | Das Team spricht vorsichtiger, die Datenqualität sinkt |
| Kauf ohne Verantwortlichen | Lizenzen gekauft, niemand verantwortet die Adoption, nach einem Quartal 20 % Logins |
| Bau eines eigenen Agenten | Prototyp in einer Woche, Wartung für immer, der Vertrieb pflegt Software |
Die ersten sechs lassen sich binnen eines Monats zurücknehmen. Die siebte kostet meist ein Jahr — weil niemand derjenige sein will, der ein vor der ganzen Firma angekündigtes Projekt beendet.
Es gibt eine achte, unbenannte: Begeisterung der Geschäftsführung. Fiel die Entscheidung auf einer Konferenz und nicht im Gespräch mit dem Vertrieb, bleibt die Adoption vorgetäuscht — das Team lernt, Nutzung zu berichten, nicht zu nutzen.
Ein Test, der dreißig Sekunden dauert
Vor dem Kauf jedes KI-Werkzeugs lohnt eine Frage: Lässt sich das Ergebnis in dreißig Sekunden prüfen?
Wenn ja, eignet sich die Aufgabe zur Automatisierung. Eine Gesprächszusammenfassung, ein CRM-Eintrag, ausgefüllte Qualifizierungsfelder — alle lassen sich mit einem Blick prüfen, weil es jeweils eine richtige Antwort gibt und Sie sie kennen.
Dauert die Prüfung so lange wie die Arbeit selbst, beseitigt das Werkzeug keine Arbeit. Es verschiebt sie — meist auf die Vertriebskraft, die damit Zeit sparen sollte.
Dieselbe Regel erklärt, warum manche KI-Anwendungen funktionieren und andere nicht. Je mehr eine Aufgabe darin besteht, Geschehenes getreu festzuhalten, desto besser gelingt sie. Je mehr sie Verantwortung verlangt — eine Situation beurteilen, über einen Rabatt entscheiden, einem Kunden antworten — desto schlechter. Diese Landkarte haben wir separat aufgeschrieben, samt der Liste dessen, was schlicht Marketing ist: KI im B2B-Vertrieb — Signal und Lärm.
Der Pilot, der nie endet
Die häufigste Art, wie eine Einführung stirbt, ist nicht Ablehnung. Es ist die fehlende Entscheidung — und sie sieht immer gleich aus:
| Element | Tatsächlicher Stand |
|---|---|
| Pilotstart | März, drei Personen, „schauen wir mal“ |
| Definierte Erfolgskennzahl | keine |
| Ausgangswert vor dem Start gemessen | keiner |
| Verantwortlicher im Vertrieb | „alle ein bisschen“ |
| Entscheidung im Juni | Pilot verlängern |
| Stand im Oktober | zwei Nutzer, Thema kehrt im Budget wieder |
Keine dieser Zeilen handelt von Technologie. Alle handeln von einer Entscheidung, die zu Beginn nicht getroffen wurde. Ein Pilot ohne Ausgangswert kann weder gelingen noch scheitern — er kann sich nur hinziehen, und Hinziehen wirkt in Organisationen sicherer als Beenden.
Drei Bedingungen genügen, damit ein Pilot eine Antwort liefert: eine Zahl, die in der Woche davor gemessen wurde; ein Entscheidungsdatum im Kalender mit dem Namen der entscheidenden Person; und ein zu Beginn laut ausgesprochenes Einverständnis mit einem negativen Ergebnis. Ohne das Dritte endet jeder Pilot im Erfolg und keiner verändert das Ergebnis.
Was Sie nicht messen sollten
Menge erzeugter Zusammenfassungen, Zahl der Modellanfragen, Verweildauer im Werkzeug — das sind die Kennzahlen des Anbieters, nicht Ihre. Alle drei steigen mit dem Engagement des Teams und keine sagt etwas über den Umsatz.
Vier, die etwas sagen: Verwaltungsstunden je Person, Zeit vom Termin bis zum Follow-up, Vollständigkeit der Qualifizierungsfelder und Prognosegenauigkeit. Die erste ist die zentrale, die zweite reagiert am schnellsten, die vierte entscheidet — aber erst nach einem Quartal.
Die ganze Bilanz, auf zwanzig Seiten
Das oben war ein Kapitel. Der Rest des Playbooks ist eine Landkarte der Anwendungsfälle nach „funktioniert, hinkt, schadet“, vier Reifegrade eines Teams, Vorteile und Nachteile in einer Tabelle — einschließlich derer, die für Werkzeuge wie unseres gelten — und ein Einführungsplan für 90 Tage.
Zum Mitnehmen
KI-Einführungen im Vertrieb scheitern selten an der Technologie. Sie scheitern am Fehlen einer vor dem Start gemessenen Zahl, am Fehlen eines Verantwortlichen und am Fehlen eines Datums, an dem jemand „funktioniert“ oder „funktioniert nicht“ sagen muss.