Was ist Gesprächsdesign für KI-Agenten?
Jemand muss entscheiden, was der Agent sagt, wenn die Erstattung abgelehnt wird. Das ist Gesprächsdesign für KI-Agenten, und es beginnt vor jedem Prompt.

Gesprächsdesign (Conversation Design) für KI-Agenten bedeutet, festzulegen, was ein Agent sagen und tun soll, bevor ihn jemand baut: Beispiel-Turns für jede Situation, die Abzweigungen, an denen etwas schiefgeht, die Systeme, die er bei jedem Schritt aufruft, den Moment der Übergabe an einen Menschen und die Stimme, in der er das alles tut. Dabei entsteht ein Dokument, das alle Beteiligten im Projekt von Anfang bis Ende lesen, diskutieren und abnehmen können, bevor jemand einen Prompt schreibt oder eine Plattform konfiguriert.
So aufgeschrieben klingt es zu selbstverständlich für eine eigene Disziplin. Trotzdem überspringen es die meisten Agent-Projekte. Sie springen von einem Foliensatz, der den Agenten beschreibt, direkt in eine Umsetzung, die den Foliensatz auslegt, und jede Diskussion, die der Foliensatz nie entschieden hat, taucht im Abnahmetest (UAT) wieder auf, wenn jede Änderung einen Sprint kostet. Gesprächsdesign heißt, diese Diskussionen früh zu führen, auf dem Papier, solange eine Änderung Minuten kostet.
Was umfasst Gesprächsdesign eigentlich?
Fünf Dinge: Beispiel-Turns, Abzweigungen, Werkzeugaufrufe, Eskalation und Stimme. Alles andere in einem Designdokument ist Zuarbeit für eines dieser fünf.
- Beispiel-Turns. Jede Situation, ausgeschrieben als konkrete Turns zwischen Kundschaft und Agent. „Der Agent begrüßt die Kundschaft und bietet Hilfe an“ ist eine Zusammenfassung; das Design zeigt eine Beispielbegrüßung. An den Beispielen entscheiden sich Ton, Verständlichkeit und rechtliches Risiko, und sie sind das Einzige, dem ein Stakeholder widersprechen kann. Einem Stichpunkt kann niemand widersprechen; einem Satz jeder.
- Abzweigungen. Der Regelfall ist der kleinste Teil der Arbeit. Die eigentlichen Entscheidungen liegen auf den anderen Pfaden: die API, die in ein Timeout läuft; wütende Kundschaft; die Anfrage außerhalb des Umfangs; Nutzende, die nach einer Möglichkeit suchen, die Regeln zu umgehen. Dazu haben wir einen eigenen Beitrag geschrieben: Der Regelfall ist kein Design.
- Werkzeugaufrufe. Ein Agent antwortet, indem er Daten aus Systemen holt. Das Design hält fest, von welchem System jeder Turn abhängt, was gesendet wird, was zurückkommt und was der Agent sagt, wenn der Aufruf fehlschlägt. Die Entwicklung liest diesen Teil zuerst.
- Eskalation. Der Moment, in dem der Agent aufhört und ein Mensch übernimmt. Wo dieser Moment liegt, was ihn auslöst und was der Agent zum Abschied sagt, sind Designentscheidungen, und nach ihnen fragt die Führungsebene zuerst.
- Stimme. Der Charakter, der den Rest zusammenhält: wie förmlich, wie warm, was er nie sagt, wie er ein Missverständnis ausräumt. Die Stimme wird einmal festgelegt und dann in jedem Turn gezeigt; nur so übersteht sie die Prüfung.
Wer macht Gesprächsdesign?
Meist Menschen, deren Berufsbezeichnung nichts mit Gesprächen zu tun hat. Drei Gruppen machen den größten Teil davon.
- Personen aus Business-Analyse, Produktmanagement und Product Ownership in Unternehmen, die einen Agenten vor die eigene Kundschaft stellen. Für viele ist es das erste ernsthafte KI-Projekt auf ihrem Tisch, und die Frage, die der Lenkungsausschuss immer stellt, landet bei ihnen: Was sagt er, wenn etwas schiefgeht?
- Beratende und Projektleitungen bei den Agenturen, die diese Unternehmen beauftragen. Sie machen aus Workshop-Notizen ein Design, und sie brauchen die Abnahme durch das Kundenunternehmen, bevor die Umsetzung beginnt, denn „So haben wir das nicht vereinbart“ in Monat vier ist ein Margenproblem. Diese Dynamik behandeln wir im Beitrag zur Abnahme eines Agent-Designs durch das Kundenunternehmen.
- Solution Architects und Forward Deployed Engineers bei den Anbietern, die den Agenten bauen und betreiben. Sie erben halb beschriebene Anforderungen, und jede Abzweigung, über die niemand entschieden hat, wird zwei Tage vor dem Go-live ihr Problem.
Es gibt auch eine eigene Berufsbezeichnung. „Conversation Designer“ entstand Ende der 2010er-Jahre rund um Sprachassistenten und Chatbots, und die Menschen, die sie tragen, sind sehr gut in dieser Arbeit. Es gibt nicht genug von ihnen, und die meisten Agent-Projekte bekommen nie eine Person mit dieser Rolle zu sehen. Das Design muss trotzdem entstehen; es macht, wer gerade im Raum ist.
Warum ist Gesprächsdesign als Tool-Kategorie verschwunden?
Weil sein wichtigstes Tool übernommen und abgeschaltet wurde und nichts an seine Stelle trat. Botmock, das führende kollaborative Gesprächsdesign-Tool der Chatbot-Ära, wurde im November 2021 von Walmart übernommen und im Dezember desselben Jahres für die Öffentlichkeit geschlossen. Voxable, das Tool, das als Umstiegsweg für Nutzende von Botmock positioniert war, hatte sich bis Ende 2022 von Conversational AI abgewandt.
Die Fachleute sind nicht verschwunden, ihr Tooling schon. Teams wichen auf Tabellen mit Intents, Miro-Boards und Textdokumente in Confluence oder Word aus, von denen keines für verzweigte Dialoge gebaut wurde. Eine Tabelle kann kein Gespräch zeigen. Ein Whiteboard lässt sich weder versionieren noch abnehmen, und eine Spezifikation in Fließtext bedeutet für jede Person, die sie öffnet, etwas anderes. Der Standard für den Entwurf von Gesprächen wurde ein Stack aus drei Tools, die einander widersprechen.
Das Timing war unglücklich. Die Kategorie brach etwa ein Jahr vor dem Moment zusammen, in dem große Sprachmodelle aus Chatbots Agenten machten und das Designproblem um eine Größenordnung schwieriger wurde. Die Branche ging das schwierigere Problem mit weniger eigens dafür gebauten Design-Tools an, als sie 2021 hatte.
Warum steht bei KI-Agenten mehr auf dem Spiel?
Weil Agenten handeln. Ein Chatbot von 2019 ordnete Ihren Satz einem Intent zu und gab eine Standardantwort zurück; im schlimmsten Fall kam ein Absatz heraus, der nicht weiterhalf. Ein Agent ruft Tools auf. Er schlägt eine Bestellung nach, meldet einen Schadensfall, veranlasst eine Erstattung, ändert eine Buchung. Er hat Seiteneffekte. Ein falsch entworfener Chatbot sagte das Falsche. Ein falsch entworfener Agent tut das Falsche, in einem echten System, aktenkundig.
Dazu kommt: Agenten improvisieren. Ein skriptgesteuerter Bot konnte nur sagen, was jemand geschrieben hatte; ein Sprachmodell erzeugt in jeder Situation etwas, auch in Situationen, die niemand entworfen hat. Das verändert, wofür das Design da ist. Es liefert weiterhin Beispiel-Turns; seine neue Aufgabe ist, die Grenzen zu ziehen: welche Formulierungen feststehen (etwa ein Compliance-Hinweis), wo der Agent umformulieren darf, was er niemals anbieten darf und was auf jedem Fehlerpfad passiert, der dem Team einfällt. Auch eine nicht entworfene Abzweigung bekommt eine Antwort: Das Modell füllt sie mit irgendetwas, und niemand hat entschieden, womit.
Wie unterscheidet sich Gesprächsdesign von Prompt Engineering und Flow-Building?
Die drei beantworten unterschiedliche Fragen in unterschiedlichen Phasen. Gesprächsdesign entscheidet, was der Agent sagen und tun soll. Prompt Engineering bringt ein Modell dazu, es zu tun. Flow-Building bindet dieses Verhalten in eine Laufzeitumgebung ein. Ein gesundes Projekt braucht alle drei, in dieser Reihenfolge; Ärger beginnt, wenn das Zweite oder Dritte das Erste ersetzen soll.
| Gesprächsdesign | Prompt Engineering | Flow-Building | |
|---|---|---|---|
| Was es entscheidet | Was der Agent sagen und tun soll, auch wenn etwas fehlschlägt | Wie man ein Modell das vereinbarte Verhalten zeigen lässt | Wie dieses Verhalten auf einer Plattform läuft |
| Wann es geschieht | Vor der Umsetzung | Während der Umsetzung | Während der Umsetzung |
| Wer es macht | Analyse, Produktmanagement, Beratung, Architektur | Entwicklung und Fachleute für angewandte KI | Platform Engineers und Builder |
| Was dabei entsteht | Ein Dokument, das jede Person lesen und abnehmen kann | Systemprompts und Eval-Sets | Ein konfigurierter, laufender Agent |
| Wenn Sie es überspringen | Unentschiedenes Verhalten taucht im UAT auf | Das vereinbarte Verhalten stellt sich nie verlässlich ein | Nichts wird ausgeliefert |
Der ausführlichere Vergleich steht in Gesprächsdesign vs. Prompt Engineering. Dort geht es auch darum, warum man Prompt Engineering immer wieder Designarbeit aufbürdet, die es nicht leisten kann.
Was enthält ein gutes Gesprächsdesign?
Mindestens sechs Dinge.
- Konkrete Beispiel-Turns im Wechsel zwischen Kundschaft und Agent.
- Abzweigungen, die danach benannt sind, wofür sie da sind: Regelfall, Randfall, Fehlerfall und feindlicher Fall.
- Eine Tool-Schnittstelle für jeden Werkzeugaufruf: welches System, was hineingeht, was zurückkommt, was bei einem Fehler passiert.
- Ausdrückliche Eskalationspunkte, mit ausgeschriebenem Übergabe-Turn.
- Ein kurzer Brief mit Ziel, Umfang, Zielgruppe und Stimme, damit sich jeder Turn an etwas messen lässt.
- Ein Abnahmevermerk, damit „Das haben wir vereinbart“ auf eine datierte Version verweist.
Eine ausgearbeitete Aufschlüsselung dieser Abschnitte finden Sie in unserer Vorlage für Gesprächsdesign, die den Kontakt mit der Entwicklung übersteht, und die Produktseite zeigt, wie jeder dieser Abschnitte als lebendes Dokument aussieht.
Wir haben Klate gebaut, weil wir diese Arbeit jahrelang in Tools gemacht haben, die nie dafür gedacht waren, und zusehen mussten, wie gute Designs in Tabellen und Foliensätzen versandeten. Klate hält das ganze Design in einem versionierten Dokument: Turns, Abzweigungen, Werkzeugaufrufe, Eskalation und einen Vermerk darüber, wer es wann abgenommen hat. Wenn diese Arbeit gerade auf Ihrem Tisch liegt, fangen Sie in Klate damit an. Im Tarif Free haben fünf Designs Platz.



