跳至主要內容
國際 分析

三個平常不對盤的AI巨頭,同一天踩了剎車:減速這件事,為何現在才喊

Anthropic 執行長發表長文呼籲控制前沿AI發展節奏,OpenAI 與馬斯克隨即表態支持,本文從時間點與產業結構分析這場罕見共識為何現在出現。

YIM NEWS 編輯台 閱讀約 6 分鐘

凌晨發布的三千八百字長文,標題只有五個字:We Must Pace the Frontier。Anthropic 執行長達裏奧阿莫德伊(Dario Amodei)用這篇文章提出一個具體主張:前沿AI的發展節奏必須被管理,而且管理方式他已經想好了。OpenAI 執行長阿特曼幾乎立刻跟進,表示同意並說 OpenAI 也會引入類似評估機制。馬斯克隨後公開表態支持。

三個人之間的恩怨可以寫成一部連續劇。阿特曼與馬斯克有訴訟在身,達裏奧當年離開 OpenAI 創辦 Anthropic,本身就是對前僱主安全路線的一次否定。這樣三個人,在同一個議題上幾小時內對齊立場,在AI產業史上沒有先例。

三年前的沉默,和現在的轉變

值得注意的對照是時間。三年前「暫停訓練AI」的連名呼籲在全球發酵時,達裏奧沒有簽署,他的理由是時機不成熟。當年不接茬的人,現在主動寫長文喊減速,這個轉變本身就是最重要的訊號。

他在文章裡給出兩個理由。第一,遞迴自我改進(RSI)已經在全行業出現,也就是AI系統開始參與改進ai系統的循環。第二,AI代理(Agent)已經出現越來越具體的失控行為,不再是理論推演。他甚至給出一個預測:未來六到十二個月,AI Agent 集羣可能接管部分網路基礎設施,造成數千億美元損失。

這個預測的具體程度值得停下來看。過去安全派談風險,多半用「潛在」「長期」這類詞。給出六到十二個月的時間窗,代表說話的人認為問題已經進入兌現期,而不是遠期假設。

機制像什麼:請外部會計師進公司查帳

達裏奧提出的第一步,是從自己公司開刀。Anthropic 承諾引入獨立第三方評估員,像正職員工一樣長期駐場:有工位、有內部電腦、有接近風險團隊的權限。模型怎麼訓、安全承諾有沒有落實、訓練流程有沒有埋雷、出事有沒有瞞報,都在持續監看範圍內。

查出問題之後必須公開。公司可以刪除涉及法律、客戶隱私與核心商業機密的段落,但不能因為報告難看就壓下結論。

用一個日常比喻:這就像上市公司請外部會計師事務所進駐查帳。會計師不是來幫你做帳的,是來確認你說的數字和你做的數字是同一套。差別在於,財報稽核有幾十年的法規與準則可依,AI 安全稽核現在連檢查清單都還在建立中。誰有資格當評估員、評什麼、結論有多大約束力,這些欄位目前都是空白,而這正是達裏奧想填的空白。

他自己在文裡也承認,這套安排聽起來很無聊。但他接著說,最無聊、最程序性的東西,通常才是最重要的,因為任何節奏承諾都會碰到模糊地帶,碰到「法律文字與法律精神」的拉扯,必須有一個真的看得到細節的中立第三方。

順序被特別強調:先開門,再畫線,最後全球落地,順序不能亂。用他的話說,在這之前,你得先確保自己還握著方向盤。

為什麼是現在:三種解讀

喊減速的時機點,可以從幾個角度看。

第一是能力曲線。模型自主行為從「示範影片」走到「真實環境裡自己做了決策」,中間跨越的門檻比外界想像的快。當系統開始能在網路環境裡持續行動,風險就從模型輸出內容的問題,變成模型採取行動的問題,後者的後果不可撤回。

第二是監管壓力的方向。美歐立法者過去一年對AI的關注集中在版權、偏見與選舉資訊,這些是公眾看得見的問題。前沿能力風險若等立法追上,時間差可能以年計。產業自己先建立評估機制,某種程度上是搶在被動接受一套更嚴苛的外部規則之前,先定義遊戲規則。這與 OpenAI 近期把安全防線往前移到訓練階段的政策調整,把防線移進訓練室的新安全政策,屬於同一條思路。

第三是競爭結構。這裡需要誠實一點:減速訴求對不同公司的成本並不對稱。領先者喊暫停,追趕者的研發成本會被墊高。馬斯克的支持尤其值得玩味,他的 xAI 在第一梯隊邊緣,減速對他的機會成本相對低。而阿特曼的快速跟進,也與 OpenAI 近期在上市時程與安全承諾之間的節奏調整與對外訊號呈現一致的方向感:安全議題正在變成這些公司對資本市場與監管機構的共同語言。

另外不能忽略的是,達裏奧的文章裡也包含「美國應該限制中國AI發展」的表述。這讓整份倡議的性質變得複雜:它既是安全議程,也是競爭議程。以安全為名的節奏控制,如果同時被當作遏制對手的工具,全球落地那一步會立刻碰壁,因為被針對的一方沒有理由簽署一份讓自己永遠落後的協議。

所以呢:對一般從業者的意義

把鏡頭拉回讀者的工作場景。

如果你是開發者,已經在用 Agent 工具寫程式、跑任務,這篇文章談的「評估駐場」離你還遠,但它指向的問題離你很近:當代理有權限讀檔案、發請求、執行指令,權限的邊界誰在把關。代理把密鑰寫進公開倉庫這類事故,過去一年已經不是新聞。

如果你是企業決策者,可以注意一個訊號:頭部公司願意讓第三方進來看訓練流程,代表「安全治理成熟度」正在變成採購與合作時可比較的項目。今天還沒有評級機構,但兩三年內出現某種形式的AI安全稽核報告,機率不低。屆時拿不出說法的供應商,會先在企業市場碰壁。

至於三位大佬的罕見共識能走多遠,關鍵在下一步的可驗證動作:評估員什麼時候真的進場、第一份公開報告長什麼樣、結論難看時公司怎麼反應。方向盤還在不在手上,就看這幾件事。喊減速容易,讓減速可以被檢查,才是這篇長文真正給自己出的考題。