Forschung

Unsere Forschung untersucht, wie generative KI-Systeme gesteuert, gemessen und abgesichert werden können — damit leistungsstarke Werkzeuge nützlich bleiben, ohne unüberprüfbar zu werden.

Kategorien

01

Sicherheit

Das Sicherheitsteam ordnet öffentliche Standards und freiwillige Rahmenwerke der Praxis für generative und agentische KI-Systeme zu.

02

Safety

Leben, Gesundheit, Eigentum und Umwelt.

03

Gültigkeit

Leistet das System das, was es behauptet — mit dokumentierten Grenzen.

04

Rechenschaft

Wer ist verantwortlich, und können andere nachvollziehen, was geschehen ist.

05

Erklärbarkeit

Können Menschen Ausgaben und Verhalten verstehen.

06

Privatsphäre

Anonymität, Vertraulichkeit und Kontrolle über Daten.

07

Fairness

Schädliche Verzerrungen und Diskriminierungsrisiken.

Papers