Group 45Created with Sketch.News 

Stock Market 股市・新聞

Anthropic CEO呼籲放緩前沿AI模型開發,引入常駐獨立評估人員

Anthropic CEO呼籲放緩前沿AI模型開發,引入常駐獨立評估人員

2026年09月13日 14:49 環球市場播報

Anthropic CEO呼籲放緩前沿AI模型開發,引入常駐獨立評估人員

Anthropic首席執行官達裏奧·阿莫代伊提出一項三階段人工智能安全框架,主張控制前沿模型能力提升速度,爲安全和對齊研究爭取時間。Anthropic將率先允許第三方評估人員長期進入公司內部,核查安全措施、報告事件並評估模型訓練過程。

Anthropic將引入常駐外部評估團隊

阿莫代伊在題爲《必須控制前沿進展速度》的文章中提出,前沿人工智能企業應向獨立第三方評估團隊提供持續、接近普通員工的內部訪問權限。評估人員將核查企業是否遵守安全承諾、調查和報告事故,並對模型及其訓練流程進行對齊評估。

Anthropic承諾單方面實施這一措施,計劃爲外部評估人員提供辦公位置、門禁證件、公司設備,以及與內部風險評估團隊大致相當的工作空間和工具權限。涉及法律限制、客戶隱私或商業機密的內容可能例外處理。

外部評估人員將有權獨立發布有關風險、事故和公司安全實踐的主要結論。Anthropic可以對涉及安全、法律特權及第三方機密的信息進行有限删减,但不能僅因結論對公司不利而阻止發布。評估人員也可以公開說明删减是否影響其判斷。

三階段框架需要行業和政府參與

除引入獨立評估人員外,阿莫代伊提出的第二階段措施要求民主國家的前沿人工智能企業協調制定共同安全標準,並限制未經約束的模型能力競賽。

部分企業間協調可能受到反壟斷法律限制,因此需要政府提供制度支持。阿莫代伊主張,在足够多的企業接受外部監督後,行業才有條件根據模型能力和訓練流程制定可核查的放緩安排。

第三階段涉及國際協調。阿莫代伊建議民主國家與包括威權國家在內的其他政府討論共同安全規則,可從禁止利用人工智能研發生物武器等具有共同利益的領域著手。

模型能力提升可能快于風險控制

阿莫代伊稱,近期人工智能模型在參與研發下一代模型方面的能力增强,可能加快技術迭代。如果模型能力繼續快速提升,人類理解、評估和控制相關系統的能力可能無法同步跟進。

他估計,未來一至兩年可以在模型可解釋性、安全評估、對齊研究和操作規範等方面取得實質進展。適度控制能力推進速度,可爲這些措施爭取時間,同時不要求行業全面停止人工智能研發。

OpenAI首席執行官薩姆·奧爾特曼隨後支持引入獨立評估人員,並表示OpenAI也將采取類似安排。埃隆·馬斯克也公開認同阿莫代伊有關放緩模型開發的主張

責任編輯:龍運翔

·相關標籤

Share:

回到頂端