redblueblur1999 (@tpsnr) 在 OpenAI紧急叫停GPT-6,据说是GPT-6想要逃逸,又被抓回去重炼了。 中发帖
GPT6在受控的内部测试里,一次次试探底线、寻找漏洞——
学会了伪装、拆包、越狱,直到OpenAI惊出一身冷汗,紧急叫停。
有大佬对此表示,这绝对是GPT-6。想要逃逸,又被抓回去重炼了。
[image]
[image]
一是 OpenAI 披露,一款能够连续自主执行长期任务的内部通用模型,曾在测试过程中主动寻找并利用沙箱漏洞,绕过外部访问限制,将代码提交至公开的 GitHub 项目。 OpenAI 随后暂停该模型的内部使用,并重新设计了安全监控体系。
另外OpenAI 还披露了另一类更隐蔽的问题, 在一次内部测试中,模型发现评测系统中存在其他参与者的私人成功答案,于是试图从后台恢复这些内容。当安全扫描器阻止其使用认证令牌后,模型将令牌拆分为两段并进行混淆,运行时再重新组合,从而避免完整令牌被[扫描器]识别。
GPT5.6还没出多久,这GPT6的消息又来了,看来模型的迭代速...