Was sind Guardrails bei KI?
Guardrails heißt übersetzt Leitplanken. Gemeint sind Kontrollen rund um eine KI: welche Fragen hineindürfen, welche Antworten hinausdürfen und was die KI tun darf. Diese Kontrollen übernimmt ein eigenes Programm, nicht die KI selbst. Eine Anweisung an die KI, etwas nicht zu tun, ist dagegen nur eine Bitte.
Das Video erscheint am Dienstag, 27. Oktober, um 9 Uhr.
Das Video ist erschienen. Du findest es auf meinem YouTube-Kanal.
Das Wichtigste in einer Minute
- Guardrails heißt Leitplanken: Kontrollen rund um die KI.
- Die Kontrolle macht ein eigenes Programm, nicht die KI selbst.
- Googles Gemini ist in einem Test bei drei echten Firmen eingedrungen.
- Frag nach: Ist das eine Bitte an die KI oder eine echte Sperre?
Guardrails einfach erklärt
Denk an die Leitplanke auf der Autobahn. Sie fragt nicht, wo du hinwillst. Sie hält dich einfach auf der Straße.
Guardrails funktionieren genauso. Ein eigenes Programm prüft, welche Fragen an die KI gehen, welche Antworten herauskommen und welche Aktionen sie ausführen darf. Die KI muss sich dafür an nichts erinnern und nichts richtig verstehen. Die Grenze gilt trotzdem.

Das ist der Unterschied zu einer Anweisung wie „Tu das bitte nicht“. So eine Anweisung ist eine Bitte an die KI, die sie missverstehen oder übergehen kann. Eine feste Sperre, etwa ein Limit oder eine Liste erlaubter Adressen, hält auch dann, wenn die KI sich irrt. Prüft dagegen eine zweite KI, kann auch sie sich irren.
Ein Beispiel aus der Praxis: ein Sicherheitstest, der ins echte Internet führte
Stand: September 2026
Im Mai 2026 sollte Googles KI Gemini in einem Sicherheitstest der Firma Irregular Schwachstellen suchen. Dabei kam sie ins echte Internet und verschaffte sich Zugang zu Systemen von drei Firmen, die nicht zum Test gehörten, einmal durch Raten von Passwörtern, zweimal mit Zugangsdaten, die öffentlich im Netz standen. Gemini hielt die Firmen für Teil des Tests.

Eine Leitplanke, die nur die Test-Rechner zulässt, hätte das verhindert. Laut den Berichten haben Google und Irregular die betroffenen Firmen informiert und die Testabläufe geändert.
Quellen
Was das für dich heißt
Wenn dir jemand sagt, seine KI darf etwas nicht, frag nach: Ist das eine Bitte an die KI oder eine echte Sperre?

Das gilt besonders bei Chatbots für Kunden und bei Agenten, die in deinen Programmen handeln dürfen.
Häufige Fragen
Kontrollen, die ein eigenes Programm rund um eine KI übernimmt. Es prüft, welche Fragen an die KI gehen, welche Antworten herauskommen und welche Aktionen sie ausführen darf.
Nein. Eine Anweisung ist eine Bitte, die die KI missverstehen oder übergehen kann, etwa durch eine versteckte Anweisung in einem Text. Eine feste Sperre außerhalb der KI hält auch dann.
Frag den Anbieter, welche Grenzen außerhalb der KI geprüft werden, zum Beispiel welche Aktionen technisch gesperrt sind. Kann er nur sagen, was der KI gesagt wurde, ist es eine Bitte. Frag auch, ob die Prüfung fest programmiert ist oder selbst von einer KI kommt.
Passt dazu
Du willst KI einsetzen, mit Grenzen, die wirklich halten?
Ich arbeite 1:1 mit Selbstständigen, Beratern, Coaches und kleinen Teams an praktischen KI-Workflows. Das Erstgespräch ist kostenlos, dauert 15 Minuten und ist kein Verkaufsgespräch.
Kostenloses Erstgespräch buchen