Eine beeindruckende Antwort in einer Demonstration sagt nicht aus, wie sich eine KI-Funktion im Arbeitsalltag verhält. Ein aussagekräftiger Test braucht eine konkrete Aufgabe, repräsentative Eingaben und Menschen, die das Ergebnis beurteilen können. Betrachten wir einen beispielhaften Supportablauf: Nach einem Gespräch schreibt eine Servicekraft eine Zusammenfassung zur Übergabe an die nächste Person. Diese Aufgabe hat eine definierte Eingabe und einen klaren Leser, wirft für das Team aber praktische Fragen zu Richtigkeit, fehlendem Kontext und Prüfaufwand auf.
Auf dieser Seite
Beschreiben Sie die heutige Aufgabe, bevor Sie KI auswählen
Beobachten Sie, wie Servicekräfte heute eine Übergabe vorbereiten. Welche Einzelheiten müssen sie finden, und wie verwendet die nächste Person die Zusammenfassung? Definieren Sie ein Ergebnis, das deren nächste Handlung unterstützt: das Anliegen des Kunden, bereits versuchte Schritte, offene Fragen und vereinbarte Folgemaßnahmen. Halten Sie fest, welche Schwierigkeit das Projekt angehen soll. Liegt das eigentliche Problem in uneinheitlichen Ausgangsinformationen, kann eine Verbesserung des Formulars oder Ablaufs Teil der Lösung sein. Vergleichen Sie einen KI-Entwurf mit der bisherigen Methode und einfacheren Alternativen anhand derselben Art von Aufgabe.
- Benennen Sie, wer das Ergebnis erstellt und wer es verwendet.
- Erfassen Sie die für die Fertigstellung nötigen Informationen.
- Bestimmen Sie das Problem, das der Test untersuchen soll.
Geben Sie der KI eine begrenzte Rolle
In diesem Beispiel soll die Funktion eine interne Zusammenfassung entwerfen, die eine Servicekraft prüft und bearbeitet. Eine Kundennachricht zu versenden oder den Fall abzuschließen wären eigenständige Fähigkeiten, die separate Entscheidungen erfordern. Legen Sie fest, auf welche Gesprächs- und Kontoinformationen die Funktion zugreifen darf und wie dieser Zugriff den Berechtigungen des Nutzers folgt. Entscheiden Sie, was bei unvollständigen Quellen oder einer nicht verfügbaren Funktion geschieht. Ein klar erkennbarer Weg zurück zur manuellen Bearbeitung hält den Ablauf nutzbar und ermöglicht dem Team, Fälle zu behandeln, die der Test nicht abdeckt.
Bewerten Sie Beispiele anhand schriftlicher Kriterien
Stellen Sie eine Prüfsammlung aus üblichen Gesprächen, unklaren Anfragen, Meinungsänderungen und fehlenden Angaben zusammen. Halten Sie einige Beispiele von denjenigen getrennt, mit denen Sie die Funktion anpassen. In einem Beispielgespräch fordert ein Kunde eine Erstattung, während die Servicekraft nur zugesagt hat, den Sachverhalt zu prüfen. Eine hilfreiche Zusammenfassung muss diesen Unterschied bewahren; „Erstattung genehmigt“ wäre eine erfundene Zusage. Bitten Sie die Prüfenden, korrekte, ausgelassene oder unbelegte Inhalte festzuhalten, statt nur einen Gesamteindruck abzugeben.
- Erforderliche Fakten: Bleiben das Anliegen und der tatsächlich vereinbarte nächste Schritt erhalten?
- Unbelegte Aussagen: Erfindet die Zusammenfassung eine Handlung, eine Zusage oder ein Kundendetail?
- Aufwand für die gesamte Aufgabe: Wie viel muss die Servicekraft prüfen und umschreiben?
- Unvollständige Eingabe: Benennt die Funktion die Lücke, statt sie mit einer Vermutung zu füllen?
Legen Sie Freigabebedingungen und eine Rückkopplung fest
Vereinbaren Sie, welche Fehler eine Veröffentlichung verhindern, welche verbleibenden Grenzen Nutzer verstehen müssen und wer die Ergebnisse prüft. Im Supportbeispiel könnte das Team verlangen, jede zugesagte Folgemaßnahme manuell zu bestätigen, bevor eine Zusammenfassung gespeichert wird. Das ist eine vorgeschlagene Ablaufregel, kein Beweis dafür, dass alle Fehler beseitigt sind. Sorgen Sie dafür, dass sich der Entwurf leicht mit der Quelle vergleichen, bearbeiten oder verwerfen lässt. Prüfen Sie nach der Einführung die Korrekturen und führen Sie bei Änderungen der Funktion die vereinbarten Beispiele erneut aus. Bewerten Sie den vollständigen Ablauf einschließlich der zusätzlichen Arbeit durch die Prüfung.

