Mozilla.ai zeigt auf der ACM FAccT: Guardrails brauchen dieselbe Prüfung wie die Modelle selbst

From Evaluation to Guardrails: What We Brought to ACM FAccT 2026

Mozilla.ai zeigt auf der ACM FAccT: Guardrails brauchen dieselbe Prüfung wie die Modelle selbst

Auf der ACM FAccT 2026 in Montreal demonstrierte Mozilla.ai, warum KI-Guardrails einer ebenso strengen Prüfung bedürfen wie die Modelle, die sie schützen. In einem Hands-on-Tutorial testeten 35 Teilnehmende kontext- und sprachspezifische Guardrails für humanitäre Szenarien in fünf Sprachen. Das Ergebnis: Agentische Guardrails mit Tools wie Websuche verbessern die Bewertung, aber das Verhalten hängt stark vom zugrunde liegenden LLM ab. Claude Sonnet 4.6 nutzte die Websuche deutlich häufiger als GPT-5 Nano. Mozilla.ai stellt mit any-guardrail und Otari Open-Source-Werkzeuge bereit, um Guardrails flexibel zu konfigurieren und auszutauschen.

Guardrails verdienen dieselbe Prüfung wie die Modelle, die sie schützen – und kontext- und sprachspezifische Evaluationsergebnisse sollten Guardrails informieren, die über statische Schadenskategorien hinaus zu dynamischen Richtlinien führen.

Mehr von diesem Tag

2026-07-23