Guardrails
Guardrails sind Sicherheitsmechanismen, die verhindern, dass KI-Systeme unerwünschte, fehlerhafte oder schädliche Ergebnisse liefern. Sie sorgen dafür, dass die KI innerhalb festgelegter Grenzen arbeitet. Beispiel: Ein Sprachassistent gibt keine unangemessenen Antworten auf provozierende Fragen.
Arten von Guardrails: eingeschränkter Datenzugriff, Einschränkung von Ausgaben (keine gefährlichen Inhalte), menschliche Überwachung vor Veröffentlichung, automatische Fehlererkennung. Anwendungsbeispiele: Inhaltsmoderation auf sozialen Plattformen, medizinische KI-Systeme, autonomes Fahren.
Warum wichtig: Sicherheit gewährleisten, Vertrauen stärken, ethische Standards wahren, gesetzliche Anforderungen erfüllen (EU AI Act). Guardrails sind ein zentrales Element verantwortungsvoller KI-Entwicklung und werden im Zuge des EU AI Act immer verpflichtender.