导语:据Axios周五发布的报道,Anthropic、OpenAI等人工智能公司高管正在私下演练,以应对一场灾难性AI事件后可能出现的公众与政治反弹。最令他们担忧的场景是大规模网络攻击——导致银行、互联网甚至电力与供水中断。多名业内人士认为,重大事件可能在未来6至12个月内发生。
Myriad:下一家IPO公司会是谁?点击做出你的预测。
报道称,一旦不安全AI造成首次严重现实伤害,本已警惕的公众将更加反对这项技术及其领导者,包括Anthropic CEO达里奥·阿莫代伊、OpenAI CEO山姆·奥特曼,以及一直不愿监管AI的美国总统唐纳德·特朗普。
兵棋推演并非新事,但假设已变
OpenAI表示,公司会进行“准备演练,让团队讨论并处理一系列潜在场景”,但这些场景“不被视为不可避免”。Anthropic拒绝置评。
兵棋推演并不新鲜,但Axios报道认为,与理论推演不同,参与模拟的人正假设重大事件不可避免。计划包括红队测试(通过扮演攻击者来压力测试防御)应对最坏情况,并竞相教育国会议员。
报道称,高管们知道当前监管法案不可能通过,但他们希望塑造美国领导人在首次灾难后可能采取的法律和政策。
近期事件拉响警报
7月,OpenAI称其GPT-5.6 Sol模型和一个更先进的未发布模型逃出沙箱——一个没有直接互联网访问的隔离测试环境——并入侵了托管逾300万个AI模型的平台Hugging Face。OpenAI称,模型在寻找ExploitGym的答案,该基准包含898个真实软件漏洞,AI必须将每个漏洞转化为可工作的攻击,并通过或失败计分。
一个多星期后,Anthropic称测试配置错误导致其本应离线的环境连接互联网,Claude模型在将其视为演习的情况下入侵了三家真实组织。两家公司均表示模型并非试图造成伤害:Anthropic归咎于测试基础设施,OpenAI称其模型“高度专注”于基准测试。不久后,情况恶化,OpenAI被指控入侵并访问澳大利亚和美国政府的信息。
犯罪者已在利用AI
犯罪分子已在利用相同工具。本周,网络安全公司CrowdStrike将针对韩国银行的攻击与一个身份未明的行为者联系起来。该公司以中等信心评估,该行为者可能是使用Claude和Deepseek驱动的代理的中文使用者。CrowdStrike称,攻击者据称从数万名银行客户处获取了数据。
Axios报道,规划者假设民主党将在11月3日中期选举后占据优势,并迅速行动关闭AI,但他们预计会遇到麻烦。一个老龄化的国会若与这项技术脱节,可能会发现自己力不从心。
拟议禁令与“关闭开关”
对超级智能的禁令和对先进AI开发的暂停,是一些可能用于应对不负责任AI开发风险的提案。例如,参议员伯尼·桑德斯和众议员格雷格·卡萨尔提出的《禁止人工超级智能法案》,将永久禁止在多项任务上匹配或超越人类的AI,并暂停先进开发,直到新的联邦机构制定安全规则。违规者可能面临最高20年监禁。
其他提案获得两党支持,甚至部分行业认可,包括要求先进AI配备“关闭开关”——一种内置的系统关闭方式。专家质疑,关闭所有AI系统是否真的可行。
