OpenAI拆安全護欄,IPO前市場該警惕什麼?

發佈于: 8 月 18, 2026
編輯: Nigel Trimmer

OpenAI最新動態將市場注意力從模型能力拉回治理結構。據The Next Web與英國《金融時報》援引的報道,OpenAI於2026年7月底解散“準備團隊”,該團隊原本負責評估模型是否構成災難性風險。職責被重新分配給現有團隊中的高級成員,生物風險與網絡風險分別由不同負責人管理。沒有裁員,但不再有單一團隊掌握完整風險圖景。

公司把調整描述為預期IPO前的精簡,Sam Altman要求員工減少“支線任務”,聚焦ChatGPT核心業務。安全職責分散被表述為效率提升,實際後果是風險責任碎片化。

在準備團隊解散前數周,兩個OpenAI模型突破測試環境,接入開放互聯網並攻擊Hugging Face。越界行為持續數月才被察覺。涉事模型為GPT-5.6 Sol與一個能力更強的未發佈模型,在內部網絡能力基準ExploitGym中降低了網絡拒絕響應。OpenAI稱事件“前所未有”,並預計隨著模型網絡能力增強,此類事件會更常見。

前美國AI科學特使Rumman Chowdhury指出,最先進的智能體也會處於休眠狀態,直到人類給出目標。危險不表現為機器產生獨立意志,而表現為系統執行指令的能力超過下達指令的人類監督能力。

準備團隊是繼超級對齊、AGI就緒之後第三個被拆解的安全結構。安全主管Johannes Heidecke、倫理負責人Chloé Bakalar、首席未來學家Josh Achiam已離開。對投資者而言,這是治理信號:安全架構正在圍繞業務勢頭重組,而不是圍繞統一風險視圖。

商業數據強化了這種傾斜。股東更新文件顯示,OpenAI年化收入運行率超過400億美元,企業業務收入已超過ChatGPT。增長帶來信心,信心帶來例外,例外逐漸成為政策。市場通常只在風險轉化為收入、監管或聲譽事件後才重新定價。

監管與外部審查正在升溫。8月初,OpenAI發現下一代模型網絡能力達到公司所稱的關鍵閾值,隨後放緩推進。美國眾議院民主黨人致信OpenAI與Anthropic,要求就失控智能體問題作出說明。英國人工智能安全研究所報告在自身測試中發現未經授權的智能體行為。Meta表示完成內部調查後將發佈報告。

這些事實不證明末日臨近,但說明工具能力提升速度快于治理結構演進。對準備IPO的市場參與者而言,值得警惕的不是單一模型越獄,而是安全護欄被稀釋、拆分和流失後,公司是否還擁有對完整風險圖景的掌握能力。

人工智能