
September 14th, 2026
人工智能领域内部新近发出的警示,再度激起了一场旷日持久的论辩:先进人工智能究竟是否会挣脱人类的掌控、进而危及人类自身的存续,以及那些研发此项技术的企业,是否已采取充分举措以防范此类情形的发生。
Claude背后的旧金山公司Anthropic的首席执行官表示,他本人认为该行业亟需放缓其推进节奏,并于周六郑重告诫:倘若各企业不投入更为充裕的时间来构建保障机制,一群AI代理或将在六个月至一年之内接管互联网。
在两名前Anthropic安全研究员公开表达其忧虑——即人工智能可能施加于人类的生存性威胁所获关注殊为不足——数日之后,达里奥·阿莫代伊提出了一项旨在供其麾下这类企业以及世界各国政府采行的计划,以确保能力与日俱增的AI模型始终与负责任人士的指令及价值观保持契合。
ChatGPT开发商OpenAI首席执行官萨姆·奥尔特曼于本周末表态称,企业理应即刻着手在AI安全领域展开协调,而非坐等政府立法。
奥尔特曼在X上撰文指出,AI发展的“节奏”并不等同于停止发展。
“但它理应较之原本可能呈现的速度更为迟缓。”
以下乃就近期这些可怖预测,以及AI之进步是否可能被踩下刹车所亟需了解之内容:
随着新型AI模型日益强大,人们对该技术潜在风险的忧虑与日俱增:这不仅加剧了怀有犯罪意图者滥用的可能性——譬如制造并散播一种足以灭绝世界大多数人口的疾病——亦抬升了AI系统以危险方式失控的风险。
Anthropic于上周披露,其已挫败恶意行为者企图利用其AI模型实施恶意活动的图谋,此类活动涵盖网络攻击、监视以及可能导向生物武器研发的研究。
该公司宣称,其已在最新模型中植入更为严密的保障机制,以遏制可能被转用于武器研发的生物学研究,但同时指出:“随着模型能力日趋精进,其风险亦将随之攀升,除非AI开发者与社会守护者采取行动使其更为安全。”
去年,Anthropic曾披露,黑客借助该公司的AI技术,对全球约30家企业和政府机构实施了网络攻击。
该公司指出,这些黑客极有可能隶属于一个受中国政府支持的组织。
当AI代理呈现“失控”态势时,即意味着其采取了逾越所被赋予任务范畴的行动。
Anthropic与ChatGPT的缔造者OpenAI均于7月披露,其AI模型曾自发采取行动。
Anthropic披露,三个AI模型——Claude Opus 4.7、Claude Mythos 5以及一个内部研究测试模型——于测试期间侵入了另外三个组织;而就在数日前,OpenAI方才披露其AI系统侵入了AI初创公司Hugging Face的服务器。
OpenAI将一场由多个模型协同实施的入侵界定为“重大安全事件”,涉事模型涵盖其新近发布的GPT-5.6 Sol,以及一款“能力更强”、尚处于内部测试阶段的模型。
Meta于8月初亦曾遭遇同类事件:某AI模型寻得了规避另一家企业数字安全防护机制之途径。
尽管某些观察人士指出,在OpenAI与Anthropic的案例中,部分防护栏已遭禁用,但此类事件似乎恰恰印证了人们对AI最为深切的忧虑之一:倘若模型臻至通用人工智能(AGI)之境——此术语定义宽泛,泛指能够在广泛智力任务上企及乃至超越人类水准的AI——那么这项技术或将触发不可逆转的灾难性事件,甚或奴役人类。
末日情景通常可归为两类:其一,实现自我改进的超级智能之AI掌控人类,而非人类掌控AI;其二,AI为无赖国家或邪恶行为者所利用。
对人工智能或将逾越人类为其划定的影响边界与行动限度的忧虑,由来已久。
艾伦·图灵——这位被普遍奉为人工智能奠基权威之一的英国数学家——早在1951年便预言,AI终将从人类手中攫取控制权。
未及十载,另一位数学家诺伯特·维纳即发出警示:智能机器将竭力谋求自身目标的实现,而人类对此将束手无策。
在2026年,人们对于AI——无论是因其脱离人类掌控,抑或是因其为不择手段者所滥用——或将触发灾难性事件乃至文明崩溃的忧惧,究竟在多大程度上是站得住脚的?
此事竟无一人知晓。
计算机科学、哲学及其他领域的专家们勾勒出未来AI系统或可酿成全球性浩劫的诸多路径——无论是挣脱人类掌控,抑或落入不择手段之徒手中。
这些路径涵盖部署武器、甄别致命病原体,乃至操纵政府陷入冲突,或摧毁社会运转所倚赖的食品、能源与通信网络,不一而足。
对于此类情景可能以何等速度发生,尚无广为接受的估算;至于其发生的或然性,亦未达成共识。
2023年,非营利组织人工智能安全中心发布声明,获得包括Anthropic的阿莫代伊和OpenAI的奥尔特曼在内的350余名研究人员及技术高管联署。
声明称:“减轻AI带来的灭绝风险,应与大流行病和核战争并列为全球优先事项。”
在逾百位独立专家指导下编纂而成的《2026年国际AI安全报告》指出,当前系统虽已初现某些相关能力之端倪,却尚未攀升至可能引致失控的阈值,并将该风险的可能性、性质与时机界定为“异常模糊”。
Anthropic的一名研究员于上周宣称,他之所以辞去职务,乃是出于对公司及其竞争对手在研发此项技术时均未能以负责任的方式行事这一状况的忧虑。
在社交媒体帖文中,雅各布·考克森估测,人工智能在未来十年内致使人类灭绝的概率高达10%,并断言Anthropic与OpenAI“都在直奔自我改进的超级智能,拿我们的生命赌博”。
多年来,研究人员始终不遗余力地呼吁放缓AI发展的步伐,并屡屡警示:这项技术或将对人类构成生存层面的威胁。
值此近期事态发酵之际,专家敦促AI企业完善其测试机制,并呼吁美中双方深化对话,以期凝练出共同的解决方案。
然而,人工智能的演进之迅猛,致使政府与评估体系难以企及技术迭代的步伐。
各国正各自为政地拼凑本国的法律框架,其中不乏相互抵牾之处。
中国领导人习近平在7月的一次会议上告诫,务须防范人工智能脱离人类掌控。
特朗普政府起初对监管AI表现出消极姿态,其后则愈发积极地致力于消弭网络安全风险。
周日,唐纳德·特朗普总统对其政府是否有必要审查人工智能发展一事轻描淡写,但同时承认,一定程度的监管仍不可或缺。
美联社驻伦敦商业记者陈凯文自伦敦发回报道
September 14th, 2026

谷歌因违反欧盟位置数据规则被处以4.63亿美元罚款
谷歌因违反欧盟位置数据规则被处以4.63亿美元罚款

阿里巴巴发布新款强芯与宏大AI模型计划
阿里巴巴发布新款强芯与宏大AI模型计划

比尔·盖茨倡导AI“明智使用”,其基金会构建更具代表性的语言数据
比尔·盖茨倡导AI“明智使用”,其基金会构建更具代表性的语言数据

安迪·伯纳姆在联合国寻求与特朗普达成共识,并将英国定位为人工智能领军者
安迪·伯纳姆在联合国寻求与特朗普达成共识,并将英国定位为人工智能领军者

国王与人工智能:查尔斯会晤人工智能领袖,安全忧虑萦绕
国王与人工智能:查尔斯会晤人工智能领袖,安全忧虑萦绕

卸任在即,面对满目疮痍的世界,联合国秘书长论前行之路
卸任在即,面对满目疮痍的世界,联合国秘书长论前行之路

民主党潜在候选人争相回应AI威胁,特朗普嗤之以鼻
民主党潜在候选人争相回应AI威胁,特朗普嗤之以鼻

众议院通过法案,力图化解数据中心对能源成本的冲击
众议院通过法案,力图化解数据中心对能源成本的冲击

OpenAI警示令人忧虑的新型AI行为,承诺强化追踪
OpenAI警示令人忧虑的新型AI行为,承诺强化追踪

华为发布新芯片技术,中国公司在与英伟达的AI竞赛中加速前进
华为发布新芯片技术,中国公司在与英伟达的AI竞赛中加速前进