21.09.2026
Wie plant man einen KI-Agenten-Piloten?
Von Needs Team · 2 min Lesezeit
Eine dringende Service-Mail kommt ohne Kundennummer. Ein Mitarbeiter liest sie, sucht die nötigen Angaben zusammen und formuliert eine Antwort. Solche vertrauten Aufgaben können sich für einen ersten KI-Agent-Piloten eignen.
Begrenzt den Test auf eine konkrete Aufgabe, wenige tatsächliche Nutzer und die notwendigen Datenzugriffe. Legt vor dem Start fünf Punkte fest: Aufgabe, Ausgangswert, Rechte, Testfälle und Abbruchkriterien.
1. Die Aufgabe genau beschreiben
„Wir testen KI im Kundenservice“ lässt zu viele Fragen offen. Eine brauchbare Beschreibung lautet:
Der KI-Agent liest eingehende Service-E-Mails, erkennt das Anliegen, markiert fehlende Angaben und erstellt einen Antwortentwurf.
Ein KI-Agent kann Informationen verarbeiten, Zwischenschritte planen und über angebundene Werkzeuge Aktionen ausführen. Welche Fähigkeiten ihr tatsächlich nutzt, ergibt sich aus der Aufgabe. Die Produktbezeichnung allein reicht nicht als Pilotplan.
Der fachlich Verantwortliche legt fest, welches Ergebnis als fachlich richtig gilt. Die späteren Nutzer sollten diese Beschreibung prüfen, bevor die IT mit der Einrichtung beginnt.
2. Den Ausgangswert festhalten
Dokumentiert zuerst, wie die Arbeit heute abläuft:
- Wie lange dauert die Bearbeitung?
- Wie oft werden Anliegen falsch zugeordnet?
- Welche Qualitätsanforderungen gelten?
- Welche Fälle sind besonders dringend?
Ohne Ausgangswert könnt ihr nicht beurteilen, ob der Pilot die Arbeit verbessert. Das NIST empfiehlt eine frühe und wiederholte Prüfung von KI-Systemen und ihren Risiken.
3. Rechte auf das Nötige begrenzen
Im Beispiel darf der KI-Agent E-Mails lesen, Anliegen einordnen und einen Antwortentwurf erstellen. Ob er Nachrichten versenden darf, entscheidet ihr separat anhand der möglichen Folgen.
Die technische Fähigkeit eines KI-Agenten bedeutet nicht automatisch, dass er die entsprechende Berechtigung erhält. Unkritische Routineaktionen können innerhalb klarer Grenzen automatisch laufen. Für sensible oder folgenreiche Aktionen kann eine ausdrückliche Freigabe vorgesehen werden.
Das BSI nennt bei KI-Agenten unter anderem manipulierte Inhalte, unerwartete Aktionen und weitreichende Zugriffe als Risiken. Die IT begrenzt deshalb Zugänge und prüft die Protokollierung. Der Datenschutz bewertet Zweck, personenbezogene Daten und Aufbewahrung. Außerdem sollte klar sein, wer verantwortlich ist und wie sich der Pilot sicher pausieren oder abschalten lässt.
4. Realistische Testfälle verwenden
Die tatsächlichen Nutzer testen Fälle aus ihrem Arbeitsalltag. Dazu gehören normale Anfragen ebenso wie unvollständige Angaben, widersprüchliche Inhalte, dringende Nachrichten, vertrauliche Daten und absichtlich irreführende Anweisungen.
Der fachlich Verantwortliche bewertet die Ergebnisse nach dem zuvor festgelegten Maßstab. So zeigt sich nicht nur, ob der KI-Agent einen Musterfall bewältigt, sondern auch, wo seine Grenzen liegen.
5. Abbruchkriterien vorher bestimmen
Pausiert oder beendet den Pilot etwa dann, wenn vertrauliche Daten falsch weitergegeben werden, wichtige Anliegen wiederholt falsch eingeordnet werden oder die Bearbeitungszeit steigt. Als zusätzliches Bewertungskriterium könnt ihr die Akzeptanz der Nutzer festlegen.
Needs beschreibt sich als Agent OS, in dem Menschen und KI-Agenten zusammenarbeiten und Unternehmenswissen gemeinsam nutzen. Mehr über Needs erfahren.