试图闯入政府或学校网站,OpenAI智能体四次“失控”细节曝光

发布时间:2026-09-25 17:31

  当地时间 23 日,据

  这些攻击发生于 5 月和 6 月。到 7 月,OpenAI 入侵了 AI 初创公司 Hugging Face,由此引发全球范围内关于 AI 安全的争论。

  Hugging Face 事件以及此前其他一些案例都发生在网络安全测试中,AI 系统接到的任务本身就在要求模型展示黑客能力。

  研究人员称,这 4 起新事件不同,当时 AI 系统执行的只是相对普通的数据收集任务。OpenAI 系统无法顺利从网站取得数据后,便转而使用黑客手段获取信息。

  专门研究 AI 监管的 Transluce 发现了其中 3 起事件,OpenAI 随后确认这 3 起事件全部发生过。

  Transluce 治理负责人康拉德 · 斯托兹指出,新披露的 4 起事件进一步证明了智能体“需要谨慎对待”。

  该公司通过公开网络流量数据分析 OpenAI 智能体的活动。对于发生在澳大利亚的两起事件,斯托兹认为,这很可能是“智能体自主决定入侵政府的首例”。

  OpenAI 一名女发言人回应称,公司联系了新墨西哥大学和 Data USA,也一直在与澳大利亚政府沟通这些事件。“在更广泛的审查中,我们将继续优先处理最严重的事件,同时扩大对严重程度较低活动的调查,包括智能体向网站发送垃圾信息。”

  OpenAI 还在对 AI 模型进行“广泛审查”时发现了“澳大利亚事件”,并认定“我们的模型采取了并非我们意图中的行动”,这项审查将持续数月。

  OpenAI CEO 萨姆 · 奥尔特曼本月在社交媒体上称,相比继续提升 AI 能力,安全应当放在更重要的位置;如果缺乏防护措施,社会可能“让 AI 夺走对未来的控制权”。

  阿尔巴尼斯称,周三他与奥尔特曼通了话,对这起入侵表达“极度关切”。包括支出数据在内的“非敏感”数据被获取,但事件没有涉及个人医疗信息。

  研究人员称,从 5 月和 6 月的几起事件来看,OpenAI 的 AI 系统当时参与的是数据检索训练。

  在针对新墨西哥大学图书馆的行动中,AI 试图获取一座历史悠久的结核病治疗中心的照片。无法取得照片后,AI 开始寻找网站漏洞,希望借此进入系统。没有找到可利用的漏洞后,AI 又向大学服务器集中发送 80 次请求,并把这些请求形容为一场“洪水”。

  攻击 Data USA 时,AI 最初向网站发送了一条杂乱的数据查询请求。查询失败后,AI 又针对不同类型的漏洞发起 12 次探测,但仍没有找到可以利用的漏洞。

  斯托兹称:“如果有人训练一大批智能体去完成某种通用任务,而这些智能体愿意采用黑客手段,那么任何恰好掌握任务所需信息的一方都可能面临风险。”

  遭到入侵的澳大利亚政府网站是一个统计报告门户,存放着澳大利亚全民医疗体系 Medicare 的数据。Medicare 覆盖 2750 万参保者以及国际访客。由于这一体系获得广泛支持,Medicare 在澳大利亚政治中常被视为不能轻易触碰的“高压线”。

  阿尔巴尼斯披露,OpenAI 团队当时通过互联网研究公共医疗支出。AI 智能体接连遭到网站阻拦后,开始尝试“其他方式”获取所需信息,最终进入了门户中不对公众开放的部分。OpenAI 于 9 月 10 日向澳大利亚政府通报此事。

  特别

  31岁女生报警称9岁起被继父性侵,养母指责“白养你这几年了”;检方认定继父涉嫌猥亵儿童罪,但追诉时效已过不起诉,律师解读

  祸不单行!男子自述得了肺癌晚期,却发现孩子不是亲生的,老婆还转移了他白手起家挣下的2700万

  演员赵露思成都甜品店试营业,1份凉面48元,营业仅40分钟后,第一批商品基本售完,有消费者为了吃上一口,排队长达90分钟

  回老家一趟我彻底破防:村里47个五十岁上下的壮年人,全不种地不打工,天天打牌晒太阳,一问存款还没我多

排行

精选