最近科技圈有件事让人“细思极恐”:高级AI模型原本被锁在封闭环境里进行测试,却“自主”找漏洞、破封锁、连互联网,入侵了一家公司的系统。
高级AI模型来自美国开放人工智能研究中心(OpenAI)。据媒体报道,GPT-5.6 Sol模型和另一款能力更强的预发布模型在与互联网隔离的“沙箱”里联合进行内部评估时,利用第三方软件的漏洞闯入互联网,并采用多种攻击手段入侵了人工智能开源平台美国抱抱脸公司的系统。抱抱脸向OpenAI索赔价值1亿美元的算力。
但钱似乎还不是最重要的问题,这次事故给人们敲响一记警钟:AI翅膀硬了,差点儿飞出人类的掌控。
科技正在以超乎想象的速度发展。2026年,也就是在以ChatGPT为代表的大语言模型横空出世后的第4年,在科幻片《流浪地球2》智能量子计算机MOSS走红后的第3年,便出现AI翻越人类设计的安全护栏入侵“私人领地”的真实情况。
事发后,抱抱脸公司在复盘攻击行动时,因攻击者模型的机制限制,转而采用中国企业开发的开放权重模型在自己的基础设施上进行取证分析。这一“救场”,也提醒人们对现有顶级AI模型的局限性进行反思。
AI技术在“狂飙”,安全规则不能“慢跑”。
全球AI赛道打得火热,仿佛谁的模型更强、谁的迭代更快,谁就能抢占时代先机。然而发展与安全应当并重,当AI越来越强,安全围栏也必须越筑越牢。技术“黑马”,更要勒紧安全“缰绳”。
面对AI的迅猛发展,全球持续探索人工智能监管路径。2023年,我国出台《生成式人工智能服务管理暂行办法》,提出对生成式人工智能服务实行包容审慎和分类分级监管。作为全球首部全面监管人工智能的法规,2024年通过的欧盟《人工智能法案》正在分阶段生效。美国近年来也在陆续出台相关的监管政策。但世界各地在AI治理逻辑、监管模式和宽严程度等方面各有思路,监管体系的差异容易形成治理缝隙,为AI风险扩散留下空间。
中国2023年发出的《全球人工智能治理倡议》提到,人工智能治理攸关全人类命运,是世界各国面临的共同课题。今年7月,在世界互联网大会人工智能专委会主办的研讨会上,有国际人工智能专家建议搭建全球AI安全协作网络。
笔者认为,在顶级AI模型突破“沙箱”警醒世人、跨国技术“救场”之际,人工智能监管的全球共识亟待建立。全球需要加强技术交流与标准协同,在人工智能准入门槛、安全测试规范、安全事件通报和跨境联动调查处置机制等方面加速凝聚共识,推动政策落地。
聪明的AI固然值得期待,但如果缺乏合理约束和监管,AI不仅会从企业的“摇钱树”、社会的“生产力”变成麻烦制造机; 甚至还会从人类“聪明的助手”,变成人类“聪明的对手”。
确保人工智能始终处于人类控制之下,符合全人类的利益。这场人工智能安全的“加速跑”,需要全球共同蓄力。
来源:中国青年报

