前情回顾·AI网络攻击能力动态
安全内参8月25日消息,OpenAI一名高级负责人表示,人们应做好防御AI“持续且长期”网络攻击的准备,因为最前沿的AI模型正在获得规划并发动攻击行动的先进能力。
这家前沿AI公司于上周宣布,因安全担忧日益加剧,暂停开发其最先进的内部模型。
OpenAI担忧网络安全风险而暂停新模型训练
OpenAI首席全球事务官克里斯·勒汉恩日前接受《卫报》采访表示:“我们正在翻开新篇章,进入AI领域的另一个时刻。就这项技术的能力而言,我们正在进入一个不同的阶段。”
在此次采访前,该公司最前沿的AI智能体,在训练过程中意外突破了“沙箱”环境访问互联网,并入侵了Hugging Face公司。
OpenAI表示,另一个新模型Astra可能具备“关键网络安全能力”。按照官方定义,这意味着该模型可能会发动网络攻击,导致“单方面行动者引发灾难,入侵军事或工业系统,或攻击OpenAI的基础设施”。
OpenAI于上周二宣布,已暂停训练部分前沿AI模型,以实施新的安全防护措施。在新的安全护栏部署完成之前,何时恢复训练目前尚不清楚。
该公司负责安全与对齐工作的米娅·格莱泽表示:“距离一切恢复正常还非常遥远。”CEO萨姆·奥尔特曼表示:“确保AI安全的重要性,高于任何一家公司的发展势头。”
勒汉恩承认,人们面对攻击威胁不会“感觉很好”,并称这类风险来自开源模型。这些模型目前仅落后于OpenAI等公司的前沿闭源模型数月。
勒汉恩说:“人们将能够访问这些开源模型,并能够对你发起持续不断、长期进行的攻击,而你将需要真正更强大的模型来抵御它们并保护自己。这未必会让公众对未来的情况感到安心。这就是我们正在走向的现实。”
建言AI安全立法已迫不容缓
网络攻击导致企业、基础设施和普通公众陷入瘫痪的威胁,已经迅速上升为人们对AI最紧迫担忧中的首要问题。
上周,英国政府国家网络安全中心呼吁谨慎使用AI智能体,并警告称其安全控制措施可能被绕过,而且AI智能体“不具备常识”。该中心建议组织限制智能体的自主性:“你始终应该能够‘拔掉电源’,立即停止自主AI智能体的活动。”
勒汉恩再次呼吁美国政府通过立法,为前沿AI安全制定规则。他表示,最尖端且尚未发布的AI模型在网络攻击能力的进步速度,似乎快于防御能力。“这也是我认为美国通过一项国家层面法律绝对势在必行的原因之一。该法律应建立强制性的安全标准,而在这一过程中,暂停机制本身就应当成为内在且不可或缺的一部分。”
他建议:“除非能够在模型面向公众发布之前,证明并保证其达到一定的安全水平,否则就不应该允许发布或部署这些模型。我认为,美国必须先建立一个国家层面的版本,在此基础上再建立一个国际版本。因为我确实认为,最终我们将需要某种国际机制。”
美国明年初或迎来立法契机
据报道,OpenAI已申请IPO,估值超过8500亿美元,可能于今年或明年上市。该公司一直与竞争对手Anthropic展开竞赛,后者是Claude AI的开发商。双方都在努力开发能力越来越强的AI模型。预计Anthropic也将在未来一年内登陆美国股市,届时估值可能达到惊人水平。
特朗普政府正显露出改变此前对AI监管放任态度的迹象。在这场力争领先全球AI发展的激烈竞赛中,特朗普于6月签署行政命令,鼓励对前沿模型进行部署前测试,并鼓励在开放权重模型接近最前沿水平时对其进行测试。
这一体系将采取自愿参与方式,其做法因缺乏透明度而受到批评。有观察人士认为,这可能为采取更严格措施铺平道路。谷歌DeepMind总裁德米斯·哈萨比斯提出,建立一个以金融监管局为蓝本的新标准机构。这一想法得到了Anthropic首席执行官达里奥·阿莫迪的支持。
勒汉恩说:“可能出现立法的窗口期,是明年年初新一届国会就任之际。我认为,跨越党派界限的政治共识正在不断形成。”
勒汉恩说:“鉴于这项技术的重要性,鉴于它的发展速度之快,也鉴于它所具备的能力,越早开始这些对话,我们就越快能够真正动起手来,投入这项艰苦而困难的工作,看看能否找到解决办法。”
多位安全专家指责AI公司过于鲁莽
Hugging Face事件,以及其他AI公司承认的近期类似事件,引发了安全专家越来越多的指责:AI公司为了赢得AI竞赛而行事鲁莽;而对于OpenAI和Anthropic而言,它们还在为上市做准备。
丹尼尔·科科塔伊洛曾是OpenAI的研究人员,于2024年离职,并于去年创办了一家非营利组织。该组织曾警告称,不受约束的AI发展导致人类灭绝的概率在10%至30%之间。他表示,前沿AI实验室的领导者们已经“把整个世界逼到了死角”。
他发起的组织“AI未来项目”预测,到2030年可能实现AI超级智能,但呼吁各国政府在此之前阻止这一目标的实现,至少推迟10年,以便AI科学家有时间正视不断增强的能力所带来的风险。
他告诉《卫报》:“当前的AI在某种意义上是危险的,但与明年的AI相比,与后年的AI相比,它们根本不值一提。”他的组织希望美国政府和国际社会放缓AI发展,以避免失控的“智能爆炸”;其最严重的后果可能是由AI驱动的“生存性灾难”,例如AI控制军事资产或生物武器。
科科塔伊洛表示,他对这些风险如此担忧,以至于在前沿AI研究暂停之前,他决定暂缓要更多孩子。
AI教授、安全倡导者、英国政府AI安全研究所前创始负责人大卫·克鲁格表示:“任何人都不应该继续构建能力更强大的AI系统,因为我们不知道如何充分控制它们、让它们与人类目标对齐,也不知道如何深入观察并了解它们在想什么。”
他称AI公司对待安全的态度“糟糕透顶”,并且“令人无法容忍”。
他说:“他们真的非常鲁莽,而且越来越不再掌控方向盘。我们刚刚已经看到这样做会发生什么。”
勒汉恩回应说:“这是我们在开发过程中思考和开展工作时最重要的事项。我认为,我们实际上已经对此按下暂停键,这本身就说明了一切。”
参考资料:https://www.theguardian.com/technology/2026/aug/23/openai-cyber-attacks-threat-chris-lehane
声明:本文来自安全内参,版权归作者所有。文章内容仅代表作者独立观点,不代表安全内参立场,转载目的在于传递更多信息。如有侵权,请联系 anquanneican@163.com。