Anthropic 執行長提出放緩 AI 發展的計畫

Anthropic 執行長 Dario Amodei 提議透過獨立監督、共享標準與國際安全協議,放緩前沿 AI 的進展。

AI News

Anthropic 執行長 Dario Amodei 呼籲放慢前沿 AI 的發展步調,並認為近期的進展已同時提升了正在打造中的系統能力與風險。他提議在領先的 AI 公司內部設置獨立評估者、就安全標準進行協調,並針對危險用途達成有限的國際協議。

這項提案標誌著焦點從對 AI 風險的廣泛警示,轉向限制發展的具體機制。OpenAI 執行長 Sam Altman 表示,OpenAI 同意公司需要「掌握前沿的步調」,並暗示將採用嵌入式評估者,儘管他未提供詳細的實施計畫。SpaceX 執行長 Elon Musk 也公開支持 Amodei 的立場。

為何 Amodei 呼籲放慢前沿 AI

在一篇新的部落格文章中,Amodei 表示,有兩項發展讓他相信 AI 公司應採取更謹慎的做法:據報導的 OpenAI-HuggingFace 駭侵事件,以及他所形容的 AI 能力急速加速。他特別強調,系統在協助打造下一代 AI 方面正變得更強。

Amodei 的論點並不是要放棄 AI 發展。相反地,他表示公司應降低模型能力提升的速度,並利用額外時間加強安全實務。他堅持 AI 可大幅改善人們的生活,但也主張這些好處取決於更審慎地打造與部署這項技術。

時機也反映出大 AI 實驗室內外日益增大的壓力。TechCrunch 報導,Anthropic 研究員 Jacob Coxon 因擔心領先公司正在承擔不可接受的風險而辭職。Amodei 的文章並未明確提及這起辭職事件,現有證據也無法證明這直接促成了他的提案。不過,這確實顯示,關於 AI 安全 的辯論,即使在前沿模型組織內部也變得更加可見。

嵌入式評估者將獲得內部存取權

Amodei 最直接的提案,是把第三方安全評估者放進前沿 AI 公司內部。他提到像 METR 這樣的組織,可用來確認企業是否遵守其在步調與安全方面的承諾,並協助確保重大事件獲得通報。

該提議安排將提供評估者公司識別證、工作空間、筆電,以及大致可與內部風險評估團隊相當的存取權。Amodei 表示,若法律或合約要求,則可有例外。他將此模式比擬為在金融機構內部運作的監管者,而不是僅依賴事後揭露。

根據 Amodei 的文章,Anthropic 正「單方面承諾」採取這種做法。Altman 形容這個想法很好,並表示 OpenAI 也會這麼做,更多細節將陸續公布。這些承諾仍屬高層聲明,而非經獨立驗證的營運方案。迄今可得的證據尚未說明評估者的權限、回報架構、資金來源,或其發布結果的能力。

這個差異對 AI 建造者與企業買家都很重要。擁有存取權但沒有權力阻止發布的評估者,可能只提供可見性,卻不改變決策。反之,真正獨立的審查功能可能影響模型上線時程、存取政策、事件應變,以及客戶在將 AI 代理 部署到敏感工作流程前所取得的證據。

協調面臨競爭與反壟斷障礙

Amodei 也提議,民主國家的大型 AI 公司應就共同安全標準與對失控進展的限制進行協調。他承認,競爭者之間直接協調可能引發反壟斷疑慮,尤其是在企業看似共同限制產品或放慢競爭時。

他的解方是由美國政府居中協調,或允許明確界定的安全討論,並提供有限的反壟斷豁免。該提案將要求政策制定者區分技術性的安全合作與反競爭行為。原始資料並未顯示此類豁免已存在,或各國政府已同意建立此豁免。

地緣政治挑戰同樣重大。批評放慢 AI 發展的人經常主張,限制可能讓中國獲得優勢。Amodei 回應說,對強大晶片與半導體製造設備的出口管制,加上對模型蒸餾更嚴格的打擊,可能在未來三到五年擴大美國的領先地位。

這些是戰略判斷,而非既定結果。它們取決於執行力、國內創新的速度、中國替代受限硬體與軟體的能力,以及盟國政府願意協調的程度。因此,Amodei 的提案把 AI 安全政策與產業政策、國家安全決策連結起來,而不是把模型開發視為僅限於公司實驗室的議題。

最狹窄的路徑或許是全球安全規則

Amodei 的最後一項提案,是在可能的情況下,由美國、其盟友與威權政府之間進行國際協調。他承認與中國合作會有明確限制,但也表示各國政府或許仍能就少數明顯危險的應用達成共識。

他以 AI 協助製造生物武器為例,指出在這類領域中,狹義禁止可能比針對 AI 發展的大型全球協議更容易達成。這類規則無法解決關於模型能力的更廣泛辯論,但可為高風險用途建立最低界線。

這種做法也回應了更廣泛的信任問題。Amodei 認為,公眾對 AI 的反彈反映出對科技公司、科技產業與政府的不信任。產業批評者,包括 TechCrunch 引述的記者 Brian Merchant,質疑末日式情境是否有足夠的逐步證據支持,並警告大範圍的安全提案可能強化 Anthropic 與 OpenAI 的市場地位。

這項批評凸顯一個核心的可信度問題:要求更多監督的公司,也會參與定義標準、存取規則與速度限制。獨立治理必須避免安全協調變成監管俘獲的機制,或成為保護既有實驗室、排擠新競爭者的工具。

接下來要看什麼

短期內最清楚的訊號,將是 OpenAI 是否公布具體的嵌入式評估者計畫,包括其獨立性、存取權、升級權限與事件通報義務。Anthropic 自身的實施同樣重要;單靠公開承諾,無法證明評估者是否能影響部署決策。

政策制定者的回應將是第二項考驗。請留意有關針對安全討論提供有限反壟斷保護、正式事件通報要求,以及管理前沿模型開發存取的規則之提案。任何政府行動都將顯示,Amodei 的想法是否能超越高層聲明。

AI 建造者與企業客戶也應觀察,這些承諾如何影響發布節奏、模型存取、安全文件,以及對高風險能力的限制。若「掌握步調」成為實際運作,企業可能會看到模型更新變慢,但也會有更有力的可靠性與濫用風險證據。若仍停留在自願層級,持續推出更強大系統的競爭壓力可能依舊不變。

Creati.ai 觀點

Amodei 的宣布之所以重要,是因為它把「掌握前沿的步調」這句話轉化為一個提議中的營運模式:在實驗室內部設置外部評估者、進行共同的安全討論,以及有限的國際規則。但這項提案仍停留在承諾階段。其價值將取決於評估者是否真正獨立,以及安全發現是否能延後或改變發布。

對市場而言,緊張點不只是 AI 發展快或慢,而是在於速度是否仍難以稽核,或是速度是否伴隨可信的監督。建造者與買家應把 Anthropic 與 OpenAI 的最新表態視為治理期望正在改變的訊號,而不是前沿發展已實質放緩的證據。

廣告