研究

我们的研究探讨如何治理、度量并保护生成式 AI 系统——使强大工具保持可用,而不至于变得无法验证。

类别

01

安全

安全团队将公开标准与自愿性框架映射到生成式与智能体式 AI 系统的实践。

02

人身安全

生命、健康、财产与环境。

03

有效性

系统是否做到其所声称的能力,并记录局限。

04

问责

谁负责,他人能否核查发生了什么。

05

可解释性

人们能否理解输出与行为。

06

隐私

匿名、保密与对数据的控制。

07

公平

有害偏见与歧视风险。

论文