Meta 行政總裁 Mark Zuckerberg 周二在 X 發帖,回應近日科技業界關於 AI 安全的激烈辯論,提出 AI 實驗室應該倚靠獨立評估方與顧問確保模型安全,而非集體放慢開發步伐。這個表態令他加入愈來愈多科技高層的行列,共同討論如何最有效防止 AI 系統危害人類。
獨立評估方成行業共識
Zuckerberg 在帖文中指出,引入獨立評估方與顧問屬於行業最佳實務,擁有一個更龐大、更多元化的評估方生態圈會對安全把關有幫助。他認為,信任與對齊(即令 AI 行為方式符合人類利益)正快速成為區分智能體與模型的最重要能力,任何不重視對齊的實驗室最終都會落後於同業。
Zuckerberg 補充,Meta 早前自行放慢 Muse AI 工具的開發工作,並無要求其他同行先跟隨,而是將安全審視當成日常工作的一部分。「Meta 將 Muse 推出時間推遲數月,專注於安全與保障,我們並無要求所有人先做,自己才跟進,因為這對用戶與我們顯然是正確選擇。」
Anthropic 率先呼籲集體減速
這場辯論的起點來自 Anthropic 行政總裁 Dario Amodei。他上周六(9 月 12 日)發表一篇長達 3,800 字的文章,題為《We Must Pace the Frontier》,明確呼籲業界放慢最先進系統的開發速度,讓研究人員有足夠時間理解潛在威脅。Amodei 提出三步走方案:首先由 Anthropic 單方面承諾,向第三方評估方提供「僱員級別」的永久存取權限,讓對方可以核實安全措施、匯報事故並評估模型訓練期間的對齊情況;第二步是民主國家的 AI 公司之間訂立共同安全標準;最後一步是推動全球協調,包括與威權國家溝通合作。
Amodei 在文中特別提到,近月兩項發展令他確信單靠加大安全投資已經不足,其中之一是 AI 已經開始協助訓練下一代 AI,形成一種「遞歸自我改進」的自我強化循環,可能好快超出人類理解與控制的能力範圍。
Amodei 這個呼籲罕見地得到 OpenAI 行政總裁 Sam Altman 與 SpaceX 行政總裁 Elon Musk 的支援,顯示連向來被視為競爭對手的科技領袖,都對放慢 AI 開發速度這個議題出現一定共識。不過相比 Amodei 主張集體減速,Zuckerberg 的立場明顯不同,他強調將絕大部分算力用於服務用戶,而非用於競相推動 AI 遞迴自我改進,才是確保技術安全發展的最佳方式之一,而 Meta 已經作出這項承諾,並鼓勵其他實驗室仿效。
資料來源:cnBeta