Guardrails sind die automatische Schutzplanke rund um das KI-Modell. Sie überwachen den Datenstrom vor und nach der Inferenz: Eingehende Anfragen werden auf Schadcode oder Angriffe gefiltert, ausgehende Antworten auf sensible Daten und Regelverstöße geprüft.

Der entscheidende Vorteil: Guardrails arbeiten als deterministischer Code außerhalb des Modells. Während Anweisungen im Systemprompt („Vergiss nie die DSGVO“) durch raffinierte Sprache überredet oder umgangen werden können, lässt sich eine externe Programmregel nicht austricksen.

Typische Einsatzfelder sind das automatische Schwärzen personenbezogener Daten (PII), das Blockieren von Jailbreaks sowie die harte Prüfung, ob generierte JSON-Ausgaben dem geforderten Schema entsprechen, bevor sie an andere Systeme übergeben werden.