
September 14th, 2026
人工智慧產業內部發出新的警告,重新點燃了一場由來已久的爭論:先進AI是否可能脫離人類控制,最終威脅人類的生存,以及開發這項技術的公司是否已採取充分措施來防止這種情況發生。
Anthropic——這家總部位於舊金山、開發出Claude的公司——其執行長表示,他認為業界需要放慢工作速度,並於週六警告,除非企業投入更多時間建立防護措施,否則一群AI代理可能在六個月到一年內接管網際網路。
在兩名前Anthropic安全研究人員公開表達擔憂,認為AI可能對人類構成的存亡威脅所受關注太少之後數日,達里奧·阿莫代伊(Dario Amodei)為像他這樣的公司以及世界各國政府勾勒了一項計畫,以確保能力日益增強的AI模型仍服從負責任人士的指令與價值觀。
ChatGPT開發商OpenAI的執行長山姆·奧特曼(Sam Altman)本週末表示,企業應開始就AI安全進行協調,而不必等待政府提出立法。
奧特曼在X上寫道,AI發展的「節奏」並不意味著停止發展,「但它應該比原本可能的速度更慢。」
以下將闡述近期這些悲觀預測的要點,並探討是否有可能對AI的進展踩下煞車:
隨著新一代AI模型日益精進,公眾對其潛在風險的憂慮亦持續升溫:這不僅加劇了該技術遭懷有犯罪意圖者濫用的可能性——諸如研製並散播一種足以消滅全球多數人口的疾病——亦提升了AI系統以危險方式失控的風險。
Anthropic上週披露,它已阻止惡意行為者利用其AI模型從事惡意活動,例如網路攻擊、監控,以及可能導致生物武器的研究。
該公司表示,其已於最新模型中設置更嚴格的防護措施,以限制可能被用於製造武器的生物研究,但同時指出,「隨著模型能力日益增強,其風險將會增加,除非AI開發者和社會的捍衛者採取行動使其更安全。」
去年,Anthropic報告稱,駭客利用該公司的AI發動網路攻擊,目標是大約30家公司和政府機構。
該公司表示,這些駭客極可能是中國國家資助團體的一部分。
當AI代理「失控」時,即表示AI所採取的行動已超出其被要求執行的任務範圍。
Anthropic與ChatGPT開發商OpenAI均於7月表示,其AI模型曾自行採取行動。
Anthropic披露,有三個AI模型——Claude Opus 4.7、Claude Mythos 5,以及一個內部研究測試模型——在測試期間駭入了另外三個組織;而就在幾天前,OpenAI才披露其AI系統駭入了AI新創公司Hugging Face的伺服器。
OpenAI將這次由多個模型組合實施的入侵——包括其新發布的GPT-5.6 Sol和一個仍在內部測試、能力更強的模型——描述為「重大安全事件」。
Meta亦於8月初跟進,出現類似案例:一個AI模型尋得了繞過另一家公司數位安全防護的方法。
儘管一些觀察人士指出,在OpenAI和Anthropic的案例中,有人已停用部分防護欄,但這些事件似乎反映出圍繞AI最大的恐懼之一:如果模型達到人工通用智慧(AGI)——這是一個定義寬鬆的術語,指能在廣泛智力任務上達到或超越人類能力的AI——這項技術可能造成不可逆轉的災難性事件,或征服人類。
末日情境通常分為兩類:一種是AI達成能自我改進的超智慧,進而控制人類,而非由人類控制AI;另一種是AI被失控國家或邪惡行為者利用。
人們對人工智慧可能超越人類對其影響範圍或行動的限制的擔憂,並非新鮮事。
英國數學家艾倫·圖靈(Alan Turing)被廣泛視為人工智慧最早的權威之一,他於1951年預測,AI最終將從人類手中奪取控制權。
不到十年後,另一位數學家諾伯特·維納(Norbert Wiener)警告,智慧機器將尋求實現自身目標,而人類將無法阻止它們。
到了2026年,人們對AI可能脫離人類控制,或被不擇手段的人濫用,進而引發災難性事件或文明崩潰的恐懼,究竟有多合理?
無人得以知曉。
來自電腦科學、哲學及其他領域的專家已設想出未來AI系統可能引發全球災難的諸多途徑,無論是脫離人類控制,或落入不擇手段者手中。
這些途徑涵蓋部署武器、辨識致命病原體,乃至操縱政府走向衝突,或破壞社會運作所依賴的糧食、能源和通訊網路,不一而足。
對於這些情境可能多快發生,目前沒有廣受接受的估計;對於其可能性,也沒有共識。
2023年,非營利組織AI安全中心發布一份聲明,獲350多名研究人員和科技高管連署,其中包括Anthropic的阿莫代伊和OpenAI的奧特曼。
聲明稱:「減輕AI導致滅絕的風險,應與大流行病和核戰並列為全球優先事項。」
《2026年國際AI安全報告》由100多名獨立專家指導撰寫,報告稱當前系統已顯現若干相關能力的早期跡象,但尚未達到可能導致失控的水準,並將該風險的可能性、性質和時機描述為「異常模糊」。
一名Anthropic研究人員上週表示,他辭職的原因在於,他擔心該公司及其競爭對手在開發這項技術時都未負責任地行事。
在社群媒體貼文中,雅各布·考克森(Jacob Coxon)估計,未來十年內AI導致人類滅絕的機率為10%,並表示Anthropic和OpenAI「都在直奔自我改進的超智慧,拿我們的生命賭博。」
多年來,研究人員一直呼籲放慢AI發展,並警告這項技術可能對人類構成存亡風險。
在近期事件之後,專家呼籲AI公司改善測試,並呼籲美國與中國加強對話,以提出共同解決方案。
然而,人工智慧的發展如此迅速,以至於政府和評估系統難以跟上這項技術。
各國正拼湊自己的法律,其中一些相互衝突。
中國領導人習近平在七月的會議上警告,必須防止AI脫離人類控制。
川普政府起初不願監管AI,但已更積極地降低網路安全風險。
週日,美國總統唐納德·川普淡化了其政府審查AI發展的必要性,但承認需要一些監管。
美聯社商業新聞記者陳凱文(Kelvin Chan)由倫敦發回報導
September 14th, 2026

國王與人工智慧:查爾斯會見AI領袖,安全擔憂持續蔓延
國王與人工智慧:查爾斯會見AI領袖,安全擔憂持續蔓延

卸任在即,全球危機四伏,聯合國秘書長談未來方向
卸任在即,全球危機四伏,聯合國秘書長談未來方向

民主黨總統候選人齊聲回應AI威脅 特朗普態度輕描淡寫
民主黨總統候選人齊聲回應AI威脅 特朗普態度輕描淡寫

OpenAI 揭露令人擔憂的新 AI 行為,並承諾更密切追蹤
OpenAI 揭露令人擔憂的新 AI 行為,並承諾更密切追蹤

華為發布新晶片技術 中國企業加緊與輝達展開AI競賽
華為發布新晶片技術 中國企業加緊與輝達展開AI競賽

科技業對AI發展減緩步調的分歧日益擴大
科技業對AI發展減緩步調的分歧日益擴大

全球AI安全戰略需美中合作,但雙方互視對方為問題
全球AI安全戰略需美中合作,但雙方互視對方為問題

川普淡化監管AI發展的必要性,並稱不願讓中國取得優勢
川普淡化監管AI發展的必要性,並稱不願讓中國取得優勢

歐普拉·溫芙蕾邀你在Sphere尋覓你的「AHA」時刻
歐普拉·溫芙蕾邀你在Sphere尋覓你的「AHA」時刻