Joule Guardrails
Stand 2026-07-24T14:00:00Z
Was ist Joule Guardrails?
Guardrails sind kein nachträglich aufgesetztes Add-on für Joule-Agenten – sie sind die verbindliche Standardhülle um jeden einzelnen Aufruf, und genau das macht sie zugleich zum Nachweis gemäß den Artikeln 9/13/14 des EU AI Act.
Joule Guardrails ist die Governance-Schicht, die zwischen jedem Joule-Agenten und dem Modell liegt, das ihn antreibt. Es ist kein Plug-in, das ein Kunde optional aktiviert — es ist die standardmäßige Ausführungshülle um jeden Joule-Skill-Aufruf, jeden Aufruf des Model Gateway und jeden in Joule Studio gebauten Workflow. Guardrails zu verstehen ist wichtig, weil es in einem SAP-Umfeld das mit Abstand konkreteste Artefakt ist, auf das man verweisen kann, wenn ein Kunde fragt: „Woher wissen wir, dass der KI-Agent nichts Falsches tut, und wie beweisen wir das einem Regulator?"
Das Framework besteht aus drei Schichten, die zusammenwirken.
Schicht 1: Content-Filtering
Jede Eingabe in einen Joule-Agenten — die Frage des Nutzers plus jeglicher Grounding-Kontext, den der Agent heranzieht — durchläuft SAPs Content-Safety-Klassifizierer, bevor sie überhaupt das zugrunde liegende Sprachmodell erreicht. Diese Klassifizierer suchen nach Prompt Injection (Text, der darauf ausgelegt ist, die Instruktionen des Agenten zu überschreiben), Jailbreak-Mustern und personenbezogenen Daten, die von vornherein nie in einen LLM-Kontext gelangen sollten. Dieselben Klassifizierer laufen beim Ausgang erneut und prüfen die vom Agenten vorgeschlagene Antwort oder Aktion auf schädliche Inhalte, durchgesickerte personenbezogene Daten und — entscheidend für regulierte Einsätze — Antworten, die über die deklarierte Risikostufe des Agenten hinausgehen (ein HR-Agent mit „begrenztem Risiko" sollte beispielsweise nie etwas erzeugen, das sich wie individualisierte Rechts- oder medizinische Beratung liest).
Warum es zählt
- Eingabe-Klassifizierer fangen Prompt-Injection- und Jailbreak-Versuche ab, bevor der Grounding-Kontext überhaupt den LLM-Aufruf erreicht
- Ein menschlicher Freigeber sieht die vom Agenten empfohlene Aktion, die stützende Evidenz aus dem Knowledge Graph und den Konfidenzwert — und kann genehmigen, ablehnen oder delegieren
- Jede HITL-Interaktion wird in einem manipulationssicheren Audit Journal protokolliert und erzeugt so Aufsichtsnachweise automatisch statt nachträglich
Kernpunkte
- Dreischichtiges Framework: Content-Filtering (Eingabe- + Ausgabe-Klassifizierer) → HITL-Eskalations-Engine → Audit Journal (manipulationssicheres Protokoll pro Inferenz).
- Standardmäßige Ausführungshülle — nicht optional; wird auf jeden Joule Skill, jeden Model-Gateway-Aufruf und jeden Joule-Studio-Workflow-Lauf angewendet.
- Zuordnung zum EU AI Act: Art. 9 (Risikomanagement) + Art. 13 (Transparenz) + Art. 14 (menschliche Aufsicht) — alle drei werden durch die drei Guardrail-Schichten erfüllt.
- Ab 02.08.2026: Hochrisiko-Joule-Agenten gemäß Anhang III ohne aktive Guardrails = regulatorischer Verstoß; Bußgeld bis zu 3 % des weltweiten Umsatzes / 15 Mio. €.
- Abwehr von Prompt Injection: Eingabe-Klassifizierer blockieren adversariale Prompt-Injection-Versuche, bevor sie das Model Gateway erreichen.
- HITL-Fehlerbild: die Besetzung der Eskalations-Warteschlange ist ein Liefergegenstand des Business-Change-Managements, kein technischer — unbesetzte Warteschlangen sind das häufigste Fehlerbild im Produktivbetrieb.
- Aufbewahrung im Audit Journal: mindestens 10 Jahre für Nachweise von Hochrisikosystemen gemäß Art. 9(7) EU AI Act.
- Joule Guardrails ist erst dann beherrscht, wenn es eine konkret benannte Kaufentscheidung verändert.
- Vor der Tool-Demonstration mit dem semantischen Vertrag und dem Kontrollmodell beginnen.
- Aktuelle Signale aus SAP-Quellen, Analystenberichten, Studien, dem Knowledge Graph und News als Beleg nutzen, nicht als Dekoration.
Begriffe auf dieser Seite
- Content-Filtering
- Automatisierte Klassifizierung von KI-Ein- und -Ausgaben gegen eine Policy-Liste (schädliche Inhalte, PII, Prompt Injection, Jailbreak-Muster) — wird vom Joule-Guardrails-Framework vor und nach dem LLM-Aufruf des Model Gateway angewendet.
- Prompt Injection
- Ein adversarialer Angriff, bei dem ein Angreifer Instruktionen in vom Nutzer eingereichten Inhalten (eine Bewerbung, ein Lieferantenformular, eine Kundenbeschwerde) verbirgt, die darauf ausgelegt sind, den System-Prompt des Agenten zu überschreiben und ihn zu unbeabsichtigten Aktionen zu bewegen.
- HITL (Human-in-the-Loop) escalation engine
- Die Komponente von Joule Guardrails, die die im Joule-Studio-Workflow definierten HITL-Bedingungen erkennt, die Agentenausführung pausiert, die anstehende Aktion in die Warteschlange eines menschlichen Freigebers leitet und die menschliche Entscheidung im Audit Journal protokolliert.
- SAP Audit Journal
- Manipulationssicherer Protokolldienst auf der SAP BTP, der jedes Joule-Agenten-Aufrufereignis erfasst — Eingabe, Prompt-Registry-Referenz, verwendetes Modell, Content-Filter-Entscheidungen, HITL-Ereignisse und ausgeführte Aktion; abfragbar als Nachweis für die EU-AI-Act-Compliance.
- EU AI Act Art. 14 (human oversight)
- Pflicht für Deployer von Hochrisiko-KI-Systemen, wirksame Aufsichtsmechanismen zu implementieren, die es Menschen ermöglichen, Situationen zu erkennen, zu verhindern oder einzugreifen, in denen sich das System entgegen seinem beabsichtigten Zweck verhält — die HITL-Eskalations-Engine ist SAPs primäre Umsetzung dieser Pflicht.
- Entscheidungsverantwortlicher
- Die verantwortliche Person, die den Trade-off akzeptiert und die nächste Aktion finanziert.
- Semantischer Vertrag
- Die gemeinsame Definition von Geschäftsbegriffen, Kennzahlen, Entitäten und Zugriffsregeln, die von Tools und Teams verwendet wird.
- Kontrollebene
- Die Ebene, die Policy, Zugriff, Lineage, Monitoring und Eskalation über das Betriebsmodell hinweg durchsetzt.
Quellen
- SAP Business AI — guardrails and responsible AI documentation
- EU AI Act Article 9 — risk management system
- EU AI Act Article 13 — transparency and provision of information
- EU AI Act Article 14 — human oversight
- EU AI Act Article 99 — penalties
- Gartner — 40% agentic project cancellation, risk-control failure
- SAP Sapphire Orlando 2026 — Joule and AI governance announcements
- artificialintelligenceact.eu — full AI Act text
- SAP Business AI — official page
- Joule with SAP Datasphere — SAP
- SAP Datasphere — Help Portal
- SAP Datasphere — official product page
- SAP Analytics Cloud — Help Portal
- SAP Analytics Cloud — official product page
- SAP BW/4HANA — Help Portal
- SAP S/4HANA — Help Portal
- SAP News Center
- SAP Community
- SAP — industries overview
- SAP Joule (work companion) — official product page
- SAP Generative AI — official product page
- Stanford HAI — AI Index Report
- Meta AI — Llama model research
- arXiv — preprint archive (cs.CL/cs.AI)
- HuggingFace — model hub
- Gartner — research & analyst site
- BARC — BI & Analytics research
- TDWI — data & analytics research
- DSAG — German-speaking SAP user group
- ASUG — Americas' SAP User Group
- Databricks — official site
Vollständige Karte für Mitglieder. Was die vollständige Karte ergänzt: den vollständigen Entscheidungsrahmen · den Vergleich SAP · Snowflake · Databricks · Fabric · die häufigen Fallstricke und ihre Behebung · die Kurzreferenz · die Architekturschemata · die Codeblöcke · die zitierfähigen Kennzahlen.