近期,一封由超過一千名前沿人工智能實驗室員工聯署的公開信,再度將“為AI發展減速”的呼聲推向風口。信函呼籲國際社會協同開發技術與治理工具,有意放緩前沿AI的推進節奏。然而,一片“慢下來”的聲浪之中,一種被忽視的逆向風險正逐漸清晰:全球減速倡議可能在真正生效前,觸發一場心照不宣的集體搶跑,將系統推向更危險的集中爆發點。
福布斯專欄作家蘭斯·艾略特(Lance Eliot)在分析中指出,這種現象並非空穴來風,而是根植于預期改變行為的古老規律。一旦市場接收到“未來將限速”的明確信號,理性參與者的第一反應往往不是趨於謹慎,而是搶在窗口關閉之前,將能力推進到盡可能遠的位置。在金融領域,這被稱為反身性——預期不僅預測事件,更主動塑造事件。減速的宣告,本身就成了加速的導火索。
這場悖論的致命之處,藏在規則生效前的最後一英里。當開發者相信嚴格的法定限制即將落地,壓縮時間線、衝刺式推進便成了最符合博弈邏輯的選擇。原本用於打磨安全邊際的時段,被擠壓成一場爭奪領先身位的急行軍。監管意圖安裝安全閥,卻無意中製造了高壓噴射口:越是臨近限速令生效,上游的衝擊壓強就越集中。工程設計中的瓶頸效應,在治理場景中同樣冷酷上演——約束越確定、窗口越短促,爆發出的瞬間能量往往越具破壞性。
更棘手的問題是,一旦前沿AI的競逐涉及國家間競爭,單向或局部的減速倡議便可能演變為優勢地位的再分配。艾略特在過往評論中反復警示,若單一國家或區域執意放慢腳步,而其他參與者並不施加同等約束,研發活動與頂尖人才並不會消失,只會向約束更寬鬆的方向遷移。全球統一減速聽起來周密穩妥,但實現這一前景需要所有參與者同意、同步遵守,並彼此確信對方沒有暗中偏離。從歷史中的軍備控制到產業聯盟的紀律維護,這類協調無一不依賴可驗證的監測、可信的懲罰機制與持續的信任。而眼下,對一個進展難以精確度量、能力邊界模糊的前沿領域而言,核查體系幾乎付之闕如。缺乏核查的限速承諾,極易淪為姿態展示,而姿態之下的猜疑鏈,比單純的樂觀更能給加速行為輸送燃料。
聯名信本身的措辭已透露出兩難境地。信中提及“有意放緩”前沿AI發展步伐,恰恰說明在高度競爭的生態裡,“有意”與“可行”之間的距離。當進展的標尺尚無法統一界定,當模型訓練、部署迭代與隱性能力提升並不像牆上的刻度那樣一目了然,任何鬆散定義的減速目標都會催生出難以追蹤的變體。規則太嚴,創新就會滲入難以監管的相鄰領域;規則太松,則等同於給投機留下側門。在這種不確定性中,相關方往往會依照最有利於自己的方式來猜測限制的實際位置——要麼將限制設想得過近而瘋狂搶跑,要麼假定限制極遠而放鬆應有的審慎。無論哪種猜測偏差,都孕育著扭曲與風險。
這並不意味著對前沿AI的安全關切不夠嚴肅,而是提醒治理設計必須直面激勵結構本身。減速倡議的意圖值得尊重,但通向目標的路徑至少與目標同等重要。如果一項政策無法解決“先行者通吃最後窗口”的衝動,無法彌合多極博弈下的信任赤字,又無法拿出可靠的進展量尺與核查方案,那麼這項試圖刹車的安排,很可能被市場解讀為衝刺的發令槍。減速的醫學表面下,藏著使高燒驟然加劇的強效催化劑。
對於政策制定者而言,需要清醒意識到,人性深處面對即將關閉的大門,本能反應是奔跑,而不是原地靜候。在監管落地前的那一刻,精明的參與者和資本已經在計算如何鎖定最後的溢價。如果不將這種“搶跑陷阱”納入頂層設計,那麼全球AI減速倡議很可能帶來的不是漸進的平穩期,而是一場被壓縮的、更不可測的預限時風暴。