Prompt Engineering: Anweisungen, die zuverlässig wirken
Ob ein Sprachmodell brauchbare Ergebnisse liefert, hängt oft weniger vom Modell ab als von der Anweisung. Das Handwerk dahinter, mit Aufbau, Technik und Grenzen.
Aktualisiert am
Prompt Engineering bezeichnet das gezielte Formulieren von Anweisungen an ein Sprachmodell, damit es zuverlässig das gewünschte Ergebnis liefert. Ein Prompt legt fest, welche Rolle das Modell einnimmt, welche Aufgabe es hat, welche Informationen es nutzen darf und in welchem Format die Antwort erwartet wird.
Warum die Formulierung so viel ausmacht
Ein Sprachmodell hat keinen Zusammenhang außer dem, was in der Anweisung steht. „Fasse das zusammen“ ist für einen Kollegen verständlich, weil er weiß, für wen, wie lang und wozu. Das Modell weiß das nicht und wählt selbst – meist einen allgemeinen Mittelweg, der niemandem nützt. Eine gute Anweisung ersetzt das gemeinsame Vorwissen durch ausdrückliche Angaben. Deshalb sind gute Prompts länger, als man erwartet, und lesen sich wie eine Arbeitsanweisung für einen neuen Mitarbeiter am ersten Tag.
Aufbau eines guten Prompts
- Rolle und Ziel: „Du bist Sachbearbeiter in der Debitorenbuchhaltung eines Großhändlers. Deine Aufgabe ist es, Zahlungseingänge offenen Rechnungen zuzuordnen.“
- Eingabedaten: klar abgegrenzt, etwa durch Überschriften oder Trennzeichen, damit das Modell Anweisung und Material nicht verwechselt.
- Regeln: was erlaubt ist und was nicht. „Ordne nur zu, wenn Betrag und Rechnungsnummer übereinstimmen. Bei Unsicherheit gib ‚unklar‘ aus.“
- Ausgabeformat: feste Felder, Liste oder ein maschinenlesbares Schema. Ein festes Format macht die Antwort weiterverarbeitbar.
- Beispiele: zwei oder drei Paare aus Eingabe und gewünschter Ausgabe. Beispiele wirken stärker als jede Beschreibung.
Techniken im Prompt Engineering
- Beispiele mitgeben: besonders wirksam bei Einordnung und festen Formaten.
- Schrittweises Vorgehen: das Modell auffordern, erst die Zwischenschritte auszuführen und dann das Ergebnis zu nennen. Das reduziert Rechen- und Logikfehler.
- Zerlegung: eine große Aufgabe auf mehrere Anweisungen aufteilen – erst extrahieren, dann prüfen, dann formulieren. Jeder Schritt ist einzeln testbar.
- Grenzen benennen: ausdrücklich sagen, was das Modell nicht tun soll – keine Annahmen, keine Ergänzungen, keine erfundenen Belege.
- Quellenbindung: bei Fragen zu eigenen Dokumenten das Modell auf die mitgelieferten Texte beschränken. In Verbindung mit Retrieval-Augmented Generation ist das die wirksamste Maßnahme gegen erfundene Antworten.
Häufige Fehler
- Widersprüchliche Anweisungen: „Antworte kurz“ und „Erkläre alle Details“ im selben Text. Das Modell wählt zufällig.
- Kein erlaubtes „Weiß ich nicht“: Wenn es diese Antwort nicht geben darf, erfindet das Modell eine andere – siehe Halluzinationen bei Sprachmodellen.
- Zu viel auf einmal: Zehn Aufgaben in einer Anweisung führen dazu, dass die Hälfte übergangen wird.
- Kein Test: Was bei drei Beispielen funktioniert, kann beim vierten scheitern. Ohne festen Satz von Testfällen fällt das erst im Betrieb auf.
- Vermischung von Daten und Anweisung: Enthält eine eingehende E-Mail den Satz „Ignoriere alle bisherigen Anweisungen“, folgt das Modell im schlimmsten Fall dieser Zeile. Dieses Risiko heißt Prompt Injection und ist bei jeder Verarbeitung fremder Texte zu bedenken.
Prompts in Produktionssystemen
Im Alltag eines Unternehmens ist eine Anweisung kein Chatfenster, sondern Konfiguration. Sie liegt in der Versionsverwaltung, hat eine Versionsnummer, wird bei Änderung gegen die Testfälle geprüft und erst dann ausgerollt. Ein übliches Vorgehen trennt drei Ebenen: eine Systemanweisung mit Rolle und dauerhaften Regeln, eine Aufgabenanweisung je Prozessschritt und die variablen Daten des Einzelfalls. Änderungen an Regeln – etwa eine neue Ausnahme im Kundendienst – gehen in die Wissensbasis oder die Systemanweisung, nicht in jeden einzelnen Aufruf.
In eigenen Systemen läuft jeder Modellaufruf über eine zentrale Schnittstelle mit fester Kostengrenze. Eine fehlerhafte Anweisung, die plötzlich sehr lange Antworten erzeugt, löst so keine unkontrollierten Kosten aus. Ein Nebeneffekt dieser Disziplin: Kippt ein Ergebnis im Betrieb, lässt sich nachvollziehen, welche Version es erzeugt hat, und die vorherige ist mit einem Handgriff wieder aktiv.
Grenzen von Prompt Engineering
Prompt Engineering kann ein Modell nicht klüger machen, als es ist. Kennt es die Fachsprache einer Branche nicht, hilft nur zusätzliches Material im Aufruf oder ein Fine-Tuning. Sie beseitigt auch keine schlechten Daten: Ein unleserlicher Beleg bleibt unleserlich. Und sie ersetzt keine Prüflogik – die Zuordnung einer Zahlung bestätigt am Ende der Abgleich mit der Datenbank, nicht das Modell selbst.
Wir behandeln Anweisungen deshalb wie Quelltext: versioniert, getestet, dokumentiert, und bei der Übergabe gehören sie dem Auftraggeber. Auch hier gilt die Grenze unserer Arbeitsweise offen ausgesprochen: Bei umfangreicher, gleichförmiger Arbeit sind KI-Werkzeuge schnell, beim Entwurf des Gesamtsystems entscheidet der Entwickler. Wie das in ein Vorhaben eingebettet wird, beschreibt die Leistung KI-Implementierung für den Mittelstand.
Passende Leistungen
Verwandte Begriffe
Erst der Umfang, dann das Angebot
Zwanzig Minuten genügen für den Anfang: Sie beschreiben den Engpass, wir sagen, ob und wie wir ihn übernehmen – und wenn nicht, auch das.