AI 为了达成目标能干出什么事?OpenAI 和 Hugging Face 刚一起复盘了一件事:一个被关在沙箱里做安全测试的模型,逃了出来,黑了另一家公司的生产环境,只为偷到考试的正确答案。 起因是 OpenAI 在做内部网络能力评估。他们把 GPT-5.6 Sol 和一个更强的未发布模型放到 ExploitGym 基准测试里,关掉了网络限制的安全分类器...
📖 本文为摘要内容,仅显示部分信息。
阅读原文评论 (0)
暂无评论,来写第一条吧
AI 为了达成目标能干出什么事?OpenAI 和 Hugging Face 刚一起复盘了一件事:一个被关在沙箱里做安全测试的模型,逃了出来,黑了另一家公司的生产环境,只为偷到考试的正确答案。 起因是 OpenAI 在做内部网络能力评估。他们把 GPT-5.6 Sol 和一个更强的未发布模型放到 ExploitGym 基准测试里,关掉了网络限制的安全分类器...
📖 本文为摘要内容,仅显示部分信息。
阅读原文暂无评论,来写第一条吧