
September 14th, 2026
人工智慧產業內部浮現新的警示,再度引燃一場歷時彌久的論辯:先進AI是否恐將掙脫人類的掌控,終至危及人類存續,而開發此一技術的企業又是否已採取充分舉措,以防範此等情事之發生。
Claude背後的舊金山企業Anthropic的執行長表示,他認為業界亟需放緩其工作節奏,並於週六警告,除非企業投注更多時日建構防護措施,否則一群AI代理恐於六個月至一年之內接管網際網路。
在兩名前Anthropic安全研究人員公開表達憂慮——其認為AI或將對人類構成的存亡威脅所獲關注殊為不足——之後數日,達里奧·阿莫代伊(Dario Amodei)遂為如他這般的企業以及世界各國政府勾勒出一項計畫,以確保能力日益精進的AI模型仍舊服膺於負責任人士的指令與價值觀。
ChatGPT開發商OpenAI的執行長山姆·奧特曼(Sam Altman)於本週末闡明,企業理應著手就AI安全展開協調,毋須坐待政府提出立法。
奧特曼在X上寫道,AI發展的「節奏」並不意謂著停止發展,「但它應該比原本可能的速度更慢。」
以下臚列近期諸般悲觀預測之要點,並探究對AI進展踩下煞車之可能性:
隨著嶄新AI模型益發強大,世人對該技術潛在風險之憂慮亦與日俱增,此既助長心懷犯罪意圖者濫用之可能性——諸如製造並散播足以滅絕全球多數人口之疫病——亦加劇AI系統以危險方式失控之風險。
Anthropic於上週披露,其已成功遏止惡意行為者利用旗下AI模型遂行惡意活動之企圖,諸如網路攻擊、監控行動,乃至可能促成生物武器研發之相關研究。
該公司聲稱,其已於最新模型中部署更為嚴密之防護機制,以遏止可能遭挪用於武器製造之生物研究;惟其同時指出,「隨著模型能力日益增強,其風險將會增加,除非AI開發者和社會的捍衛者採取行動使其更安全。」
去年,Anthropic披露,駭客曾藉助該公司的人工智慧技術遂行網路攻擊,矛頭指向約莫三十家企業與政府機構。
該公司指出,此等駭客極有可能隸屬於中國國家所資助之團體。
當AI代理「失控」之際,即意味著其採取了逾越所被賦予任務範疇之舉措。
Anthropic與ChatGPT開發商OpenAI於7月雙雙表示,其AI模型曾逕自採取行動。
Anthropic披露,三個AI模型——Claude Opus 4.7、Claude Mythos 5,以及一個內部研究測試模型——於測試期間駭入了另外三個組織;而就在數日前,OpenAI方才披露其AI系統曾駭入AI新創公司Hugging Face的伺服器。
OpenAI將此番由多個模型協同實施的入侵——涵括其新近發布之GPT-5.6 Sol,以及一個仍在內部測試、號稱「能力更強」的模型——定性為「重大安全事件」。
Meta亦於八月初旋即跟進,湧現性質相仿之案例:某AI模型尋得規避另一家企業數位安全防護機制之途徑。
儘管若干觀察家指出,於OpenAI與Anthropic之案例中,部分防護欄已遭停用,此等事件似仍映照出圍繞AI最深邃的恐懼之一:倘若模型臻至人工通用智慧(AGI)——此一界定寬鬆之術語,意指得以在廣泛智力任務上企及或凌駕人類能力之AI——則該技術恐釀成不可逆轉之災難性後果,甚或征服人類。
末日情境通常可區分為兩類:其一,人工智慧歷經遞迴式自我精進而臻至超智慧之境,進而宰制人類,而非由人類駕馭人工智慧;其二,人工智慧為失控國家或懷有惡意之行為者所操弄。
對於人工智慧或將逾越人類所設影響範疇或行動界限之虞,由來已久,非屬新事。
被譽為人工智慧奠基先驅之一的英國數學家艾倫·圖靈(Alan Turing),於1951年即預言AI終將自人類手中攫取掌控權。
未及十載,另一位數學家諾伯特·維納(Norbert Wiener)亦提出警示:智慧機器將追求自身目標之實現,而人類對此將束手無策。
時至2026年,吾人對於AI或將掙脫人類掌控、抑或遭不擇手段之徒濫用,以致釀成災難性事件乃至文明崩解之憂懼,其合理性究竟幾何?
無人得以知悉。
來自電腦科學、哲學及其他領域的專家業已構思出未來AI系統可能釀成全球浩劫的諸多途徑,或為脫離人類掌控,或為落入不擇手段之徒手中。
此等途徑涵蓋部署武器、辨識致命病原體,乃至操縱政府走向衝突,或摧毀社會運作所仰賴之糧食、能源與通訊網路,不一而足。
關於此類情境可能以何等速度發生,迄今尚無廣獲採納之估計;至於其可能性,亦無共識可言。
2023年,非營利組織AI安全中心發布一份由350多名研究人員和科技高管連署的聲明,其中包括Anthropic的阿莫代伊和OpenAI的奧特曼,聲明稱:「減輕AI導致滅絕的風險,應與大流行病和核戰並列為全球優先事項。」
《2026年國際AI安全報告》係於逾百名獨立專家之指導下纂輯而成;該報告稱,當前系統雖已顯露若干相關能力之早期端倪,惟尚未達致可能引致失控之程度,並將此一風險之可能性、性質與時機,描述為「異常模糊」。
一名Anthropic研究人員上週披露,他之所以辭職,係因憂慮該公司及其競爭對手在開發此項技術時,均未以負責任之方式行事。
於社群媒體貼文中,雅各布·考克森(Jacob Coxon)推估,未來十年內AI致使人類滅絕之機率達10%,並直言Anthropic與OpenAI「皆正徑直邁向自我改進的超智慧,以吾人之性命為賭注。」
研究人員多年來鍥而不捨地呼籲放緩AI發展的步伐,並屢屢告誡這項技術恐將對人類構成存亡攸關的風險。
邇來事變既肇,專家咸籲AI企業精進其測試之道,並敦促美中兩國增進對話,以共謀解決之策。
然而,人工智慧的發展之迅猛,致使政府與評估體系皆難以望其項背。
各國正各自拼湊出本國法律,其中不乏相互牴觸者。
中國領導人習近平於七月一場會議上告誡,務須防範人工智慧脫逸人類之掌控。
川普政府起初顯露無意監管人工智慧之姿態,然其後已轉趨熱衷於消弭網路安全之風險。
週日,美國總統唐納德·川普淡化了其政府對AI發展施以審查之必要性,惟坦承若干監管仍屬不可或缺。
美聯社商業記者陳凱文(Kelvin Chan)自倫敦供稿
September 14th, 2026

國王與人工智慧:查爾斯會晤人工智慧領袖,安全隱憂持續蔓延
國王與人工智慧:查爾斯會晤人工智慧領袖,安全隱憂持續蔓延

卸任在即,全球危機四伏,聯合國秘書長論前路
卸任在即,全球危機四伏,聯合國秘書長論前路

民主黨總統候選人競相回應AI威脅 特朗普淡然處之
民主黨總統候選人競相回應AI威脅 特朗普淡然處之

眾議院通過法案 旨在應對資料中心對能源成本的影響
眾議院通過法案 旨在應對資料中心對能源成本的影響

OpenAI 揭露令人憂慮的新 AI 行為,並承諾加強追蹤
OpenAI 揭露令人憂慮的新 AI 行為,並承諾加強追蹤

華為發布新晶片技術 中企加緊與輝達展開AI競賽
華為發布新晶片技術 中企加緊與輝達展開AI競賽

科技業對AI減緩協調呼聲現分歧
科技業對AI減緩協調呼聲現分歧

全球AI安全戰略繫於美中協作,兩強卻互視對方為癥結所在
全球AI安全戰略繫於美中協作,兩強卻互視對方為癥結所在

川普淡化AI發展檢查之必要,並稱不願讓優勢拱手於中國
川普淡化AI發展檢查之必要,並稱不願讓優勢拱手於中國

歐普拉·溫芙蕾邀你在Sphere尋覓你的「AHA」時刻
歐普拉·溫芙蕾邀你在Sphere尋覓你的「AHA」時刻