WissenKI-Begriffe für Solos

Leitplanken bei KI einfach erklärt, wie du verhinderst dass ein Agent zu weit geht

Ein Agent tut nur, wofür er die Werkzeuge hat. Leitplanken legen fest, welche Aktionen automatisch laufen dürfen und wann er erst deine Bestätigung braucht.

Tommy Hummel-Nguyen
Tommy Hummel-Nguyen · Ingenieur, kein Softwareentwickler ·

Ein Fahrlehrer lässt seinen Schüler wirklich fahren, greift aber über das zweite Pedal ein, bevor etwas passiert. Der Schüler entscheidet die meiste Zeit selbst, wann er bremst oder lenkt, nur an der Grenze übernimmt der Lehrer. Leitplanken bei einem KI-Agenten funktionieren nach demselben Prinzip: die KI arbeitet weitgehend selbstständig, an bestimmten Stellen greift eine vorher festgelegte Regel ein.

Kurz gesagt

Leitplanken sind Regeln, die vor, während oder nach einem Agentenlauf prüfen, was er tun darf, unabhängig davon, wie eine Anfrage formuliert ist. Sie legen fest, welche Werkzeuge ein Agent überhaupt nutzen kann, welche Aktionen automatisch laufen und welche erst deine Bestätigung brauchen. Ohne Leitplanken tut ein Agent alles, wofür er technisch die Werkzeuge hat, ungeprüft.

Wie Leitplanken technisch funktionieren

Die einfachste Leitplanke ist der fehlende Zugriff: hat ein Agent kein Werkzeug zum Versenden von E-Mails, kann er auch keine verschicken, egal wie geschickt eine Anfrage formuliert ist. Darüber hinaus gibt es Prüfungen, die vor jedem Schritt laufen, etwa ob eine geplante Aktion überhaupt zum erlaubten Bereich gehört, und Prüfungen, die das Ergebnis danach kontrollieren, bevor es an dich oder nach außen geht. Für riskantere Aktionen, etwa eine Zahlung auslösen oder eine Datei löschen, kommt zusätzlich eine Bestätigung durch dich dazu, bevor irgendetwas tatsächlich passiert.

Wer für welche Leitplanke verantwortlich ist

Ein Missverständnis hält sich hartnäckig: dass ein KI-Anbieter automatisch dafür sorgt, dass sein Modell nicht zu weit geht. Tatsächlich trägt nur ein Teil davon der Anbieter selbst, nämlich das Modell. Welche Werkzeuge ein Agent bekommt, welche Regeln vor und nach jedem Schritt greifen und in welcher Umgebung er läuft, legst du fest, wenn du den Agenten einrichtest. Die eigentliche Sicherheit entsteht also nicht durch das Modell allein, sondern durch das Zusammenspiel aus Modell, den Regeln drumherum und den Werkzeugen, die du ihm tatsächlich in die Hand gibst.

Warum das für dich als Solounternehmer zählt

Sobald ein Agent nicht nur antwortet, sondern selbstständig etwas erledigt, zum Beispiel Rechnungen ablegen oder E-Mail-Entwürfe schreiben, entscheiden Leitplanken, wie viel davon wirklich ohne dich läuft. Ein sinnvoller Startpunkt: Dateizugriff auf einen einzelnen Ordner beschränken, keine Löschrechte vergeben, ausgehende Nachrichten grundsätzlich nur als Entwurf ablegen statt sie automatisch zu verschicken. Genau diese Art von Kontrolle steckt auch hinter der Rechtevergabe in Claude Code: du legst einmal fest, was erlaubt ist, statt bei jeder Aktion einzeln zuzustimmen.

Die Grenze

Leitplanken senken das Risiko, sie heben es nicht auf null. Eine Regel kann nur das abfangen, woran vorher jemand gedacht hat, ein neuer, ungewöhnlicher Fall rutscht im Zweifel durch. Deshalb bleibt gerade am Anfang wichtig, was ein Agent tatsächlich getan hat, im Nachhinein zu prüfen, auch wenn die Leitplanken vorher grünes Licht gegeben haben. Und ein Punkt, der leicht vergessen wird: auch Kostenbegrenzungen zählen dazu, ohne sie kann ein Agent, der in einer Schleife hängt, unbemerkt sehr viele Anfragen und damit Kosten verursachen.

Quellen: Guardrails (OpenAI Agents SDK) · Guardrails and human review (OpenAI API Docs)

Häufige Fragen

Sind Leitplanken dasselbe wie Berechtigungen?

Eng verwandt. Berechtigungen legen fest, worauf ein Agent überhaupt zugreifen kann, Leitplanken prüfen zusätzlich, ob eine geplante Aktion im Einzelfall sinnvoll und erlaubt ist.

Kann ich Leitplanken nachträglich einrichten?

Ja, jederzeit. Die meisten Agenten-Werkzeuge, auch Claude Code, lassen sich so konfigurieren, dass bestimmte Aktionen erst nach deiner Bestätigung ausgeführt werden.

Machen Leitplanken einen Agenten langsamer?

Etwas, ja. Eine zusätzliche Prüfung oder eine Bestätigung kostet Zeit. Für risikoarme, routinemäßige Schritte lohnt sich das kaum, für Aktionen mit echten Folgen ist der Zeitverlust den Sicherheitsgewinn wert.

Willst du das bei dir umsetzen?

In der Community zeige ich, was bei mir hält. Im Erstgespräch schauen wir uns dein Vorhaben konkret an.