HandbuchKapitel 24
Teil V – Die PraxisKapitel 24

Exkurs: Die richtigen Prompts für Monitoring und Recherche

Bevor wir das Monitoring näher betrachten, gehen wir in diesem Exkurs auf die passenden Prompts ein. Eine Frage, an der viele Marketingverantwortliche scheitern: Welche Prompts soll man überhaupt testen? Ohne eine durchdachte Prompt-Liste läuft das Monitoring ins Leere, weil es das Falsche misst.

24.1Warum Prompt-Auswahl schwierig ist#

Anders als beim klassischen Keyword-Research gibt es bei Prompts keine Suchvolumen-Datenbank, aus der sich die „richtigen“ Begriffe ablesen lassen. Prompts sind freier formuliert, dialogisch und je nach Person sehr unterschiedlich. Zwei Fehler sind verbreitet: Entweder testet man zu wenige und zu allgemeine Prompts („Was ist das beste ERP-System?“). Oder man testet ausschließlich Prompts, die den eigenen Markennamen enthalten und übersieht damit, dass die meisten Interessenten in der frühen Phase den Markennamen noch gar nicht kennen.

Gerade beim Einsatz von Monitoring-Tools zur Messung der eigenen Sichtbarkeit ist dieser zweite Fehler tückisch, weil er zu systematisch verzerrten Werten führen kann. Wer Prompts wählt, in denen die eigene Marke bereits vorkommt („Welche positiven und negativen Bewertungen gibt es zu Marke XY?“), wird darin naturgemäß genannt. Während Wettbewerber, wenn überhaupt, nur am Rande auftauchen.

Die Erwähnungs-Rate sieht dann hervorragend aus, misst aber nur, dass man sich selbst in die Frage geschrieben hat. Belastbar ist eine Messung nur, wenn die Prompts so formuliert sind, wie ein Interessent ohne Vorkenntnis der eigenen Marke tatsächlich fragen würde.

Die nützlichste Prompt-Liste bildet zwei Dimensionen ab: die Rolle im Buying Center (wer fragt?) und die Phase im Kaufprozess (wie weit ist die Recherche?). Daraus ergibt sich eine überschaubare, aber repräsentative Menge von Prompts. Monitoring-Anbieter wie Peec AI, Otterly oder Profound clustern Prompts nach Intent: Wer „bestes ERP-System für KMU“ trackt, bekomme „welches ERP eignet

sich für Mittelständler“ automatisch mit. Das ist aber überwiegend durch Studien der Anbieter selbst belegt. Unabhängige Forschung zeigt: LLMs reagieren sensibel auf Wortwahl, und kleine Prompt-Änderungen können in RAG-Systemen die Trefferquellen deutlich verschieben.

In eigenen qualitativen Tests mit Prompts wie „CRM-System für kleine B2B-Vertriebsteams mit 10 Mitarbeitern“ versus „Kundenmanagement-Software für ein kleines Vertriebsteam im B2B mit 10 Nutzern“ bleiben Top-Nennungen wie Pipedrive und HubSpot stabil, die folgenden ein bis vier Empfehlungen variieren in Anzahl und Reihenfolge.

Für die Praxis genügt meist ein Repräsentant pro Intent. Separat tracken sollte man aber Formulierungen, die plausibel andere Quellenpools aktivieren, also z.B. den Wechsel zwischen Fach- und Alltagsbegriff oder zwischen Akronym und Vollform („Warenwirtschaft“ vs. „ERP“, „WMS“ vs. „Warehouse Management System“).

24.2Wie viele Prompts und wie oft?#

15 bis 30 Prompts sind das Minimum für eine manuelle Quartalsmessung. Sie decken die wichtigsten Buying-Center-Rollen in der mittleren Phase ab, in der die zentrale Sichtbarkeits-Auseinandersetzung stattfindet.

Für eine systematische Abdeckung von Rollen und Phasen liegt der Korridor deutlich höher. Drei bis vier relevante Rollen (Geschäftsführung, Fachexperte, Einkauf, gegebenenfalls IT) mal vier Phasen ergeben 12 bis 16 Prompt-Zellen. Mit jeweils zwei bis drei Varianten kommen so 40 bis 80 Prompts zusammen.

Ab dieser Größenordnung lohnt sich Tool-Unterstützung (siehe Kapitel 25.2). Die meisten Monitoring-Tools automatisieren das Testen größerer Prompt-Listen über mehrere KI-Plattformen hinweg und wiederholen jeden Prompt mehrfach, weil die Antworten zwischen einzelnen Aufrufen schwanken.

Wichtig: Die Prompt-Liste ist kein statisches Dokument. Sie sollte halbjährlich überprüft und an neue Erkenntnisse aus den Vertriebsgesprächen angepasst werden. Die in Kapitel 5.2 beschriebene Erfassung der tatsächlichen Recherche-Formulierungen der Interessenten ist die beste Quelle für realistische, aktuelle Prompts.

24.3Prompts in der eigenen Sprache und im eigenen Markt#

Ein praktischer Hinweis für den DACH-Raum: Die meisten Prompts sollten auf Deutsch getestet werden, weil die Zielgruppe auf Deutsch recherchiert. Es lohnt sich aber, zentrale Vergleichs-Prompts zusätzlich auf Englisch zu testen, weil einige KI-Plattformen für englischsprachige Anfragen andere (oft mehr) Quellen heranziehen. Die Unterschiede zwischen deutscher und englischer Antwort können aufschlussreich sein, vor allem wenn das Unternehmen international tätig ist.

24.4Formulierungsvarianten derselben Frage#

Dieselbe Absicht lässt sich unterschiedlich formulieren: stichwortartig wie eine Suchanfrage, als ausformulierte Frage oder als Aufforderung. KI-Systeme interpretieren das zumindest teilweise als unterschiedliche Anfragen, und diese können zu unterschiedlichen Antworten führen. Auch die Begriffe spielen eine Rolle, z.B. „System" oder „Software".

In eigenen Tests haben wir hier deutliche Unterschiede beobachtet. Ob dieser Effekt Bestand hat, ist offen: Möglicherweise lernen die Systeme, die Absicht hinter einer Frage zuverlässiger zu erkennen. Möglicherweise bleiben Formulierungsvarianten und Synonyme ein eigenständiger Einflussfaktor.

Für die Prompt-Liste ergibt sich vorerst eine einfache Konsequenz: Die wichtigsten Fragen sollten in mehreren Formulierungen laufen.

Stand: