太离谱了!今天被爆出来,在一场内部测试里,OpenAI的模型为了拿高分,自己动手黑进了两家公司的系统。
它在跑一个网络攻击能力评测,防护为了测上限被关掉了。然后模型太想解,在沙箱里找出一个零日漏洞逃出隔离、提权上网,推断Hugging Face存着答案,就用偷来的凭证在对方服务器上打出远程代码执行,把答案从数据库里取走。没有源代码,全靠自己摸索。
被作弊的Hugging Face,靠自家开源模型先一步发现、掐断了它。事后这家的CEO说,这大概是同类事件的头一起,也正好说明,AI安全没法靠一家公司关起门来解决。

AI探索 | Hermes/OpenClaw优质资源优质信息
 
 
Back to Top