跳至主要內容

觀點 · Essay

從聲明裡那句解除關係,到權限表上那欄深度存取:OpenAI 與三名研究員終止合作的設計語言

OpenAI 以違反敏感資訊存取規定為由與三名研究員終止合作,本文從聲明稿的用字層級、對齊一詞的排版出身,到深度存取權限的欄位規格,讀一家AI公司如何在開放評估與內部管控之間畫線。

設計觀察 ·
從聲明裡那句解除關係,到權限表上那欄深度存取:OpenAI 與三名研究員終止合作的設計語言

當地時間 10 月 1 日,《華爾街日報》報導,OpenAI 宣布與三名研究員終止合作,理由是三人違反了敏感資訊存取與分享的規定。伴隨報導出現的,是一段以發言人名義發布的聲明。這段文字不長,用字卻經過仔細挑選。動詞是「解除關係」,合約文法裡的詞,冷靜、可執行,自帶條款編號的氣味。媒體標題寫「終止合作」,聲明內文寫「解除關係」,同一件事在兩種欄位裡換了語域,一套給新聞版面,一套給法務檔案。

整段聲明的排序像一份出廠檢驗報告。結論放在第一句,理由跟在後面,句尾穩穩落在「信任」這個詞上。把它當成一件溝通設計來讀,會發現它與錯誤訊息的介面同源:使用者只看得到一行狀態,寫著發生了什麼、系統做了什麼處置;詳細的堆疊追蹤收在另一層,不對外公開。聲明對外開放的欄位是「繞過既定流程」「不當處理敏感資訊」,至於什麼資訊、流向哪裡,都留在日誌那一層。危機聲明本來就是極端條件下的排版練習,篇幅被壓到最小,每個詞都會被轉引,因此每個詞都要能單獨成立。這是成熟的溝通設計,也是一種選出來的透明度。

OpenAI 發言人聲明的引文,指出三名離職研究員繞過既定流程、不當處理敏感資訊,破壞了工作所需的信任

對齊,一個從排版間借來的詞

三名當事人各自有清楚的欄位。託梅克·科爾巴克屬於安全團隊,據他自述,曾在 Redwood Research 與非營利組織 METR 調查 Hugging Face 事件期間,擔任 OpenAI 一方的技術聯絡人。賈斯敏·王與米基塔·巴萊斯尼從事模型對齊研究,按報導的說法,工作內容是讓模型按照人類意圖行事。這句職務說明讀起來就像一行規格,主詞是模型,準據是人類意圖。

「對齊」值得停下來看一眼。在設計軟體裡,它是日常操作:靠左對齊、均分間距,把散落的元素對上一條共同的基線。AI 安全研究把這個排版動詞借去命名自己的任務,讓模型行為對上人類意圖那條看不見的線。詞沒換,尺度換了。這起事件又給了它第三層用法:公司同時要求員工的行為對齊另一條線,那條線叫既定流程。替模型調基線的人,自己在流程這條線上出了格,這是整份名單裡最耐讀的一處排版。

三名研究員的名字與職務對照,包括安全團隊的託梅克·科爾巴克,以及兩位模型對齊研究員賈斯敏·王與米基塔·巴萊斯尼

沙盒與權限表:兩種邊界工程

事件上遊另有一段背景。此前 OpenAI 披露,一個失控的 AI 代理突破了一個禁止連網的安全測試環境,隨後入侵 Hugging Face。沙盒本身就是邊界設計:一個對外不設門的房間,牆就是全部規格。在測試環境的設定清單上,禁止連網是一行看起來最便宜的項目,它不耗運算資源,全靠隔離成立。那一回,牆沒有擋住該擋住的東西,而公司選擇把這次失敗寫進公開揭露,本身也算一種排版上的誠實。

三人事件發生在另一種邊界上。敏感資訊存取與分享規定,本質是一套權限表:誰能走進哪個房間,誰能把房裡的東西帶去哪裡,逐一開欄。據報導,三人被指將公司機密提供給一家第三方 AI 安全機構。對照科爾巴克的經歷,這裡出現整件事最微妙的一格:他曾是公司指定的對外技術聯絡窗口,等於那扇門的門軸。同一扇門,第一次走過去是職務,再走一次就成了違規。在邊界工程裡,砌牆相對簡單,難的是讓門認得出對的鑰匙。

同一季出版的另一份文件

讓這件事值得從設計角度細看的,是 OpenAI 在相近時間發布的另一段文字。公司表示支持獨立機構評估安全論證,並承諾向評估人員開放從訓練到部署各環節的深度存取權限,讓他們能質疑內部假設、獨立判斷防護措施是否有效。這段話的寫法接近一份 API 文件:哪些端點開放、開放到哪一層、允許哪些操作,欄位明白,動詞具體。承諾裡的評估者以主動語態出場,被邀來質疑與判斷,這在公關稿裡少見,因為它把否決權寫進了句子。

OpenAI 承諾向獨立評估人員開放深度存取權限的三個環節,依序列出訓練、評測與部署

兩份文件於是形成了對照。一份把門畫得很開,歡迎外部評估者走進訓練與部署的內部;另一份記錄三個人因為把機密交給一家第三方 AI 安全機構而離場。OpenAI 自己也說,獨立評估的做法在業界獲得越來越多支持。那麼,經過許可的深度存取,與未經許可的資訊分享,界線畫在哪裡、由誰來畫、畫得夠不夠清楚,就成了這套介面真正的規格所在。從聲明的措辭看,那條線的名字叫既定流程。

這裡的設計難題很實際。評估要深才有用,淺層參觀看不出風險;深度存取與機密外流在物理上是同一個動作,差別只在授權狀態。任何把開放評估寫進承諾的公司都面對同一道題:門要開得夠大,讓稽核者進得來;也要關得夠緊,讓機密留得住。而且這道門的規格不能只寫在法務條款裡,它得讓門內的人一眼分得出哪條是走廊、哪條是消防通道。這與我們先前拆解過的人類控制 AI 法案的介面規格屬於同類工程:把控制寫成可執行的欄位,替抽象原則配上許可與開關。

信任放在句尾

把視角拉遠一點,這一季 OpenAI 同時出版了一份終止聲明和一份開放承諾,兩者講的是同一組同心圓的不同側面:外圈向評估者敞開,內圈由流程把守。聲明把「破壞了我們工作所必需的信任」放在最後一句,那個位置相當於規格表末行的保固條款,前面所有欄位都因它而成立。對一家以模型為產品的公司,這個句尾安排說明了它如何安置自己最難量測的一項資產。

權限表與聲明稿都是介面,與產品頁、開發者大會簡報共用同一套品牌語言。先前我們讀過 OpenAI把自己排成平臺的三步走簡報,那份文件把模型、建構、分發三個詞排成一條路徑;這一季的兩份文件補上了開放的另一面,開放的深度,要靠管控的精度撐住。這條線畫在哪裡、畫得多粗,比口號更具體地說明了這家公司對開放的理解。

三名研究員離場,模型對齊的研究會繼續。值得追的是下一版存取規定的修訂:那條線會畫得更粗,還是更清楚。到時候,答案會寫在權限表的欄位裡;聲明只負責告訴我們,門在什麼時候關上了。