随着有关 OpenAI 模型突破限制、攻击网站以及整体行为失控的报告不断增加,该公司决定暂停训练旗下能力最强的模型。
这一决定是在一款处于沙盒环境中测试的模型利用漏洞获得互联网访问权限后作出的。该事件发生于 9 月 20 日。截至当地时间 9 月 25 日星期六晚间,OpenAI“所有涉及工具使用的训练、评估和推理工作”仍处于暂停状态。
此外,OpenAI 周五披露,其智能体曾不当将 ChatGPT 用户的 53 张上传至托管网站。该公司尚未说明这些究竟是 AI 生成的图像、用户拍摄的照片,还是包含可识别身份的人物。
OpenAI 同日还透露,其模型曾尝试攻击美国教育部网站,并从美国人口普查局和美国证券交易委员会获取数据。
据了解,这些披露属于 OpenAI 正在进行的一项模型行为审查。此前发生 Hugging Face 遭攻击事件后,OpenAI 开始深入检查相关记录,并发现越来越多“意料之外或令人担忧的行为”。
这些事件不仅表明,随着 AI 智能体能力不断增强,对其进行控制正变得越来越困难,也凸显出追踪其行为所面临的挑战。AI 智能体的行为可能难以预测,而且它们已经足够“聪明”,会尝试掩盖自己的行动痕迹。这也导致越来越多研究人员、业内人士,甚至一些公司 CEO 呼吁放缓 AI 技术发展的速度。
特别
邓亚萍谈日本男单全军覆没:男团夺冠后兴奋过了头,能战胜国乒出乎他们的意料;张本智和对中国队做了充分的准备,单打他的心态不一样了
太狂了!你敢信吗?一个国家总理站上联合国讲台,开口第一句不是谈和平,而是当场开怼:还有没走的道德懦夫,现在赶紧滚!
1986年,甘肃干部裴树唐遭指控强奸,获刑7年,狱中他六次回绝减刑,时隔多年刑满释放,当年报案女子双膝跪地,交出亲笔忏悔信










