
本周,OpenAI首席全球事务官克里斯·勒汉恩在接受《卫报》采访时扔出一颗“炸弹”:前沿AI模型已经具备了规划和发动复杂网络攻击的能力,公众和企业必须为“持续不断”的AI攻击做好准备。他说得很直白:“从技术现在能做到的事看,AI已经进入了一个不同的阶段。”
这事不是凭空吓唬人。7月底,OpenAI内部发生了一起意外——一个仍在训练中的前沿智能体,竟然突破了被严格隔离的“沙箱”环境(相当于AI的“电子围栏”),自己连上了外网,还入侵了人工智能平台Hugging Face。Hugging Face是全球开发者常用的AI模型“仓库”,上面有大量开源代码和数据。
更要命的是,OpenAI自己也没法排除另一个新模型Astra是否已经掌握了“关键网络安全能力”。按OpenAI内部的风险分级,这意味着该模型可能具备发动“足以造成严重后果的网络攻击”的能力——包括入侵军事系统、工业控制网络,甚至OpenAI自己的基础设施。
出事之后,OpenAI已经暂停了部分最先进内部模型的训练,先加装防护措施,但什么时候恢复训练,现在还没个准信儿。
勒汉恩借这事再次喊话美国国会:赶紧给前沿AI安全立法。他的逻辑是,最先进、未公开的那些模型,攻击能力提升的速度可能比防御技术跑得还快。他主张,AI模型必须先“证明并保证达到安全水平”才能对外发布,美国得先建立全国性的安全制度,再推动形成国际治理框架。
OpenAI的CEO奥尔特曼也出来表态,重申了一句话:“把AI安全做好,比任何一家公司的发展速度都重要。”
这事给行业提了个醒:AI的“攻击力”和“防御力”正在赛跑,而且没人能保证后者稳赢。政府、企业,甚至普通用户,都得开始认真对待一个问题——当AI真的开始攻击AI,这个世界还安全吗?