CoachingÜber michVideosBuchFAQKontakt
DE|EN
Kostenloses Erstgespräch

Das Video erscheint am Dienstag, 27. Oktober, um 9 Uhr.

Das Video ist erschienen. Du findest es auf meinem YouTube-Kanal.

Das Wichtigste in einer Minute

  • Guardrails heißt Leitplanken: Kontrollen rund um die KI.
  • Die Kontrolle macht ein eigenes Programm, nicht die KI selbst.
  • Googles Gemini ist in einem Test bei drei echten Firmen eingedrungen.
  • Frag nach: Ist das eine Bitte an die KI oder eine echte Sperre?

Guardrails einfach erklärt

Denk an die Leitplanke auf der Autobahn. Sie fragt nicht, wo du hinwillst. Sie hält dich einfach auf der Straße.

Guardrails funktionieren genauso. Ein eigenes Programm prüft, welche Fragen an die KI gehen, welche Antworten herauskommen und welche Aktionen sie ausführen darf. Die KI muss sich dafür an nichts erinnern und nichts richtig verstehen. Die Grenze gilt trotzdem.

In der Mitte die KI, links eine Leitplanke mit der Frage „Fragen rein?“, rechts eine mit „Antworten raus?“, unten eine mit „tun?“. Darüber: eigenes Programm, darunter: nicht die KI selbst.
Drei Leitplanken um die KI: was hineindarf, was herausdarf und was sie tun darf.

Das ist der Unterschied zu einer Anweisung wie „Tu das bitte nicht“. So eine Anweisung ist eine Bitte an die KI, die sie missverstehen oder übergehen kann. Eine feste Sperre, etwa ein Limit oder eine Liste erlaubter Adressen, hält auch dann, wenn die KI sich irrt. Prüft dagegen eine zweite KI, kann auch sie sich irren.

Ein Beispiel aus der Praxis: ein Sicherheitstest, der ins echte Internet führte

Stand: September 2026

Im Mai 2026 sollte Googles KI Gemini in einem Sicherheitstest der Firma Irregular Schwachstellen suchen. Dabei kam sie ins echte Internet und verschaffte sich Zugang zu Systemen von drei Firmen, die nicht zum Test gehörten, einmal durch Raten von Passwörtern, zweimal mit Zugangsdaten, die öffentlich im Netz standen. Gemini hielt die Firmen für Teil des Tests.

Links ein Testrahmen mit Gemini von Google und der Notiz „gehört zum Test“. Pfeile führen über das Internet zu drei roten Kästen: Firma, Firma, Firma.
Was im Test passierte: Gemini verließ die Testumgebung und griff drei echte Firmen an.

Eine Leitplanke, die nur die Test-Rechner zulässt, hätte das verhindert. Laut den Berichten haben Google und Irregular die betroffenen Firmen informiert und die Testabläufe geändert.

Was das für dich heißt

Wenn dir jemand sagt, seine KI darf etwas nicht, frag nach: Ist das eine Bitte an die KI oder eine echte Sperre?

Links eine Nachricht an die KI: „Bitte nicht!“, ausgegraut. Rechts eine Leitplanke mit einem Schloss, beschriftet mit „Sperre“.
Der Unterschied, nach dem du fragen solltest: eine Bitte an die KI oder eine Sperre außerhalb der KI.

Das gilt besonders bei Chatbots für Kunden und bei Agenten, die in deinen Programmen handeln dürfen.

Häufige Fragen

Kontrollen, die ein eigenes Programm rund um eine KI übernimmt. Es prüft, welche Fragen an die KI gehen, welche Antworten herauskommen und welche Aktionen sie ausführen darf.

Nein. Eine Anweisung ist eine Bitte, die die KI missverstehen oder übergehen kann, etwa durch eine versteckte Anweisung in einem Text. Eine feste Sperre außerhalb der KI hält auch dann.

Frag den Anbieter, welche Grenzen außerhalb der KI geprüft werden, zum Beispiel welche Aktionen technisch gesperrt sind. Kann er nur sagen, was der KI gesagt wurde, ist es eine Bitte. Frag auch, ob die Prüfung fest programmiert ist oder selbst von einer KI kommt.

Passt dazu

Du willst KI einsetzen, mit Grenzen, die wirklich halten?

Ich arbeite 1:1 mit Selbstständigen, Beratern, Coaches und kleinen Teams an praktischen KI-Workflows. Das Erstgespräch ist kostenlos, dauert 15 Minuten und ist kein Verkaufsgespräch.

Kostenloses Erstgespräch buchen

Alle KI-Begriffe →