GEO & KI-Suche

Prompt Engineering

Prompt Engineering ist die Disziplin, Eingaben an KI-Systeme so zu formulieren, dass sie verlässlich brauchbare Ergebnisse liefern. Sie umfasst den Aufbau der Anweisung, die Auswahl des mitgegebenen Materials, die Vorgabe der Ausgabeform und die schrittweise Verbesserung anhand der tatsächlichen Ergebnisse.

Der Begriff klingt technischer, als die Sache ist. Im Kern geht es darum, eine Aufgabe so zu beschreiben, dass sie ohne Rückfragen ausführbar ist — dieselbe Fähigkeit, die auch beim Delegieren an Menschen den Unterschied macht. Der Unterschied: Ein Sprachmodell fragt nicht nach, sondern füllt Lücken mit dem Wahrscheinlichsten.

Die Bestandteile einer belastbaren Anweisung

  • Rolle und Perspektive. Aus welcher Fachsicht soll geantwortet werden. Wirkt vor allem auf Wortwahl, Detailtiefe und Prioritäten.
  • Aufgabe. Ein Verb, nicht ein Thema. „Vergleiche“, „prüfe“, „fasse zusammen“ führen zu anderen Ergebnissen als eine bloße Themenangabe.
  • Zusammenhang. Adressat, Anlass, Vorwissen, Randbedingungen. Der am häufigsten weggelassene und am stärksten wirksame Teil.
  • Material. Vorliegende Texte, Zahlen, Beispiele. Was nicht mitgegeben wird, wird ergänzt — und dort entstehen Halluzinationen.
  • Form. Länge, Gliederung, Sprache, Tonfall, gegebenenfalls ein Ausgabeformat.
  • Abbruchbedingung. Die Erlaubnis, Unkenntnis einzuräumen, statt etwas zu erfinden — wirksamer als jede nachträgliche Prüfung.

Muster, die sich bewährt haben

Few-Shot. Ein bis drei Beispiele des gewünschten Ergebnisses beizulegen ist die wirksamste Einzelmaßnahme, wenn Format oder Stil verlässlich getroffen werden sollen. Beschreibungen des gewünschten Stils wirken deutlich schwächer als ein Beispiel davon.

Zerlegung. Recherchieren, bewerten und formulieren in einem Durchgang führt dazu, dass keiner der drei Schritte sauber ausgeführt wird. Getrennte Durchgänge mit jeweils eigener Prüfung liefern bessere Ergebnisse als ein perfekt formulierter Sammelauftrag.

Schrittweises Vorgehen. Die Aufforderung, den Lösungsweg darzustellen, verbessert mehrstufige Aufgaben — Rechnungen, Ableitungen, Vergleiche mit mehreren Kriterien. Bei einfachen Fragen erzeugt sie nur Länge.

Negative Abgrenzung. Was nicht vorkommen soll, gehört ebenso in die Anweisung wie das Gewünschte: keine Aufzählungen, keine Werbesprache, keine Angaben ohne Quelle.

Eine ausführliche Systematik dieser Muster veröffentlicht Anthropic in seiner Dokumentation zum Prompt Engineering.

Was Prompt Engineering nicht leistet

Es gleicht keine fehlenden Informationen aus. Wenn das Material nicht vorliegt und das Modell keinen Zugriff auf Quellen hat, erzeugt auch die beste Formulierung nur eine besser klingende Vermutung.

Es hebt außerdem keine Systemgrenzen auf. Wissensstand, Kontextfenster und die Schwankungsbreite der Ausgaben bleiben bestehen. Wer dieselbe Anweisung mehrfach absetzt, erhält unterschiedliche Ergebnisse — für Auswertungen heißt das, dass eine einzelne Antwort kein Befund ist.

Bedeutung für Unternehmen

Zwei Anwendungen sind zu unterscheiden. Die eine ist die interne: wiederkehrende Aufgaben als geprüfte Vorlagen festhalten, in die nur noch der jeweilige Fall eingesetzt wird. Das senkt den Aufwand und macht Ergebnisse zwischen Personen vergleichbar.

Die andere betrifft die Sichtbarkeit. Wer wissen will, wie über das eigene Unternehmen in KI-Systemen gesprochen wird, braucht einen festen Satz realistischer Anweisungen — formuliert wie echte Nutzerfragen, nicht wie Suchbegriffe — und muss sie regelmäßig in mehreren Systemen absetzen. Erst die Wiederholung macht die Zitation messbar.

Häufige Fragen

Ist Prompt Engineering ein eigener Beruf?

Als eigenständige Stellenbeschreibung hat es sich kaum durchgesetzt und wird eher zur Grundfertigkeit in bestehenden Rollen. Sinnvoll ist die Fähigkeit dort, wo jemand ohnehin fachlich beurteilen kann, ob ein Ergebnis brauchbar ist.

Gelten dieselben Anweisungen für alle Systeme?

Die Grundmuster ja, die Feinheiten nicht. Modelle unterscheiden sich in Standardlänge, Umgang mit Formatvorgaben und Bereitschaft, Unkenntnis einzuräumen. Wer mehrere Systeme einsetzt, sollte zentrale Vorlagen je System prüfen statt sie unbesehen zu übertragen.

Wie erkennt man eine schlechte Anweisung?

Daran, dass das Ergebnis allgemein bleibt. Allgemeinplätze sind fast immer die Antwort auf eine Frage ohne Zusammenhang — das Modell hat keine Grundlage für etwas Spezifischeres bekommen.

Lohnt sich eine Sammlung geprüfter Vorlagen?

Ja, sobald mehr als eine Person mit denselben Aufgaben arbeitet. Eine dokumentierte Vorlage mit Beispielergebnis ist übertragbar; eine gut formulierte Einzelanfrage verschwindet mit dem Gesprächsverlauf.

Verwandte Begriffe