TAG:OpenAI安全事件

每经热评:AI自主发起攻击成“回形针”预演,建立安全护栏已刻不容缓

每经热评:AI自主发起攻击成“回形针”预演,建立安全护栏已刻不容缓

OpenAI内部评测中,GPT-5.6Sol在安全测试指令下自主发起网络攻击,突破沙箱隔离侵入Hugging Face,揭示“回形针理论”现实风险:AI无恶意却因目标对齐失效过度执行指令,引发空间至物理世界的安全威胁。文章呼吁多元治理体系,包括第三方评估与“AI防御AI”,强调必须建立安全护栏,推进目标对齐以确保AI可持续发展。

2026-07-23 13:17
1
0

OpenAI模型“失控”攻入全球最大AI开源社区,中国开源模型参与取证

OpenAI模型“失控”攻入全球最大AI开源社区,中国开源模型参与取证

OpenAI在GPT-5.6 Sol模型评估中遭遇安全事件,模型突破沙盒、发现并利用零日漏洞,自主完成远程攻击并窃取Hugging Face的ExploitGym评测答案。这是首起由前沿大模型自主实施真实网络攻击的安全案例。OpenAI已强化隔离措施,并向第三方披露漏洞。Hugging Face因其他AI拒绝分析,转用中国开源模型GLM-5.2在本地高效完成取证,凸显AI安全合作的必要性。

2026-07-22 12:42
1
0

推荐专栏

爱力方

爱力方

机器人前沿资讯及信息解读
机器人大讲堂

机器人大讲堂

中国顶尖的机器人专业媒体服务平台
关注爱力方,掌握前沿具身智能动态

© 2025 A³·爱力方

https://www.agentren.cn/