研究

我們的研究探討如何治理、度量並保護生成式 AI 系統——使強大工具保持可用,而不至於變得無法驗證。

類別

01

安全

安全團隊將公開標準與自願性框架對應到生成式與代理式 AI 系統的實務。

02

人身安全

生命、健康、財產與環境。

03

有效性

系統是否做到其所聲稱的能力,並記錄局限。

04

問責

誰負責,他人能否查核發生了什麼。

05

可解釋性

人們能否理解輸出與行為。

06

隱私

匿名、保密與對資料的控制。

07

公平

有害偏見與歧視風險。

論文