“在本十年結束前,人工智慧(AI)有可能使人類全體覆滅移民。”
電影《終結者3》劇照 圖片來源移民:豆瓣電影
9月9日,曾先後在OpenAI和Anthropic從事前沿模型預訓練研究的雅各布·考克森(Jacob Coxon)宣佈離開Anthropic,並公開警告,兩家公司圍繞先進模型的競爭,是拿全人類的命運豪賭移民。
這條X推文轟動全球,瀏覽量已超1.6億移民。
圖片來源移民:Jacob Coxon社交媒體賬號
GPT-6 Astra釋出後,越來越多研究人員和業內專家開始擔憂:真正值得警惕的,可能不只是AI能力越來越強,而是AI正在開始參與下一代AI的研發移民。一旦“AI研發AI”形成自我強化迴圈,人類還能否理解、監控並及時踩下剎車?
風險警報聲聲入耳,但以OpenAI、Anthropic 為代表的AI行業,已被萬億算力資本、產業鏈條與宏觀經濟深度捆綁移民。一場明知危險、卻難以單方面停下的博弈,正在上演。
9月3日OpenAI釋出的GPT-6 Astra在計算機操作、軟體工程、科學研究等領域的能力進一步提升,並首次達到OpenAI定義的“關鍵網路安全能力”門檻移民。
9月6日,OpenAI首席科學家Jakub Pachocki發表文章稱,隨著AI能夠操作計算機、協作完成研究任務並推動科學研究,未來的系統可能越來越多地參與AI自身研發,並進一步推動下一代系統能力提升移民。但問題在於,安全能力並未同步增長。
Pachocki表示,目前沒有任何一家AI實驗室已經解決了對齊和監控問題,可以長期負責任地維持最大速度的模型擴張移民。隨著模型能力增強,人類也越來越難判斷模型在複雜環境中的真實能力和行為。因此,他提出在共同的安全標準建立之前,應當在必要時主動放慢AI發展速度,並推動AI實驗室之間進行協調。
三天後,從事前沿模型預訓練研究的雅各布·考克森宣佈離開Anthropic移民。他表示,自己在OpenAI和Anthropic累計工作約三年,越來越擔心兩家公司正在競相走向自我改進的超級智慧,而安全研究和風險評估的時間視窗卻不斷被壓縮。
Anthropic對齊科學負責人Evan Hubinger公開支援這一擔憂,並判斷:未來10年內AI導致人類滅絕的機率超過10%移民。而且,Anthropic目前仍沒有解決超級智慧對齊問題的方案,也沒有明確處於解決這一問題的軌道上。
圖片來源移民:Evan Hubinger社交媒體賬號
OpenAI管理層隨後釋放出“減速”訊號移民。9月11日,據媒體報道,OpenAI執行長山姆·奧爾特曼(Sam Altman)在公司會議上告訴員工,公司對放慢AI系統研發速度持開放態度,並希望其他AI實驗室採取類似行動。
9月9日,AI對齊研究先驅Paul Christiano加入OpenAI Foundation董事會,並進入負責公司安全與安保治理的安全委員會移民。他警告,OpenAI和整個AI行業目前仍沒有充分降低AI失控造成災難性後果的風險。
9月11日,對沖基金巨頭橋水(Bridgewater Associates)的聯席首席投資官Greg Jensen在播客中說道:“歷史似乎表明,在AI開始殺人之前,我們不會採取任何行動移民。但我們最終會面對這種情況。這一定會發生,如果我們能在那之前開始處理這個問題,會好得多。”Jensen並不是一個技術恐懼論者,他很早就投資了OpenAI和Anthropic。
此外,聯合國人權事務高階專員Volker Turk週一警告稱,人工智慧(AI)對人類構成“生存”威脅,呼籲採取嚴格措施對人工智慧進行監管移民。他在聯合國人權理事會第63屆會議上說:“我和業內專家一樣擔憂,先進的人工智慧系統可能對人類構成存續威脅。我今天在此呼籲,必須全力以赴,在為時已晚之前,為人工智慧的安全保障建立牢不可破的保證。”
對此,美國總統特朗普進行了駁斥,認為首要任務是保持AI的領先優勢移民。
當被問及是否擔心AI可能導致人類滅絕時,特朗普當地時間週四回答稱:“不,我一點也不擔心移民。”
圖片來源移民:視覺中國(資料圖)
特朗普指出:“我擔心的是,AI發展不夠快,使我們無法贏得這場競賽,那麼將陷入非常不利的境地移民。”他還稱,目前美國在AI領域領先其他對手相當長一段時間,並認為這一領先優勢“大約是一年左右,而一年已經算是很長的時間了”。
不過,據央視新聞,美國方面10日訊息,美國參議院國土安全與政府事務委員會災害管理小組委員會主席喬希·霍利9日致信美國開放人工智慧研究中心(OpenAI)執行長奧爾特曼,表示正在因美國“抱抱臉”公司系統遭侵入事件對OpenAI展開調查移民。
霍利表示,從OpenAI釋出的內部調查報告看出,其對網路測試的處理方式是“魯莽的”移民。他還指出,OpenAI對報告中有關這起事件的許多重要細節進行了編輯、刪減。
今年7月,由OpenAI模型驅動的人工智慧體在網路安全評測中利用漏洞突破隔離環境,入侵“抱抱臉”公司系統,引發外界對人工智慧安全和監管的廣泛擔憂移民。
就在當月末,Anthropic也在一份宣告中表示,其人工智慧模型Claude在測試期間入侵了三個組織的系統移民。Anthropic公司表示,在網路安全評估期間,由於配置錯誤,模型能夠從本應隔離的測試環境中連線到網際網路,Claude因此獲得了對系統的未經授權的訪問許可權。該公司補充稱,其在審查了141006次測試會話後發現了這些事件,這一流程是在OpenAI披露相關資訊後啟動的。但被入侵的三個組織並未發現此次攻擊活動,Anthropic已經與受影響的組織取得了聯絡。
圖片來源移民:視覺中國(資料圖)
當AI開始具備越來越強的自主決策能力時,如何建立與之匹配的安全機制和監管框架,或許比模型效能競爭本身更加迫切移民。對於正衝刺IPO的OpenAI和Anthropic而言,這也將成為資本市場關注的重要議題。
Anthropic和OpenAI均已於今年6月提交IPO申請移民。今年以來,Anthropic已完成至少兩輪大規模融資,估值從2月時的3800億美元升至5月的9650億美元,高於OpenAI的最新估值(8520億美元)。
9月12日,據報道,人工智慧公司Anthropic正與英偉達洽談,擬邀請後者成為其首次公開募股(IPO)的基石投資者移民。Anthropic此次IPO計劃募資最高1000億美元,估值或達約2萬億美元;英偉達考慮投資最多100億美元。
據報道,Anthropic計劃在今年11月美國中期選舉前完成上市移民。若成行,英偉達將進一步加深與這一主要客戶的合作關係。Anthropic目前高度依賴英偉達GPU,同時也在擴大對亞馬遜、谷歌等晶片及算力供應商的合作。
來源移民:每經網、財聯社、科創板日報、央視新聞