跳到主内容
开云登录入口

接连发生 AI 失控事件,OpenAI 再次暂停其最强模型训练

2026-09-26 · 开云登录入口 · 更新于 2026-09-28

IT之家 9 月 27 日消息,由于有关 OpenAI 模型突破限制、攻击网站以及整体行为失控的报告持续增多,该公司决定暂停其最强模型的训练工作。

这一决策源于一个在沙盒环境中测试的模型,它通过利用漏洞获得了互联网访问权限。该事件发生在 9 月 20 日。截至当地时间 9 月 25 日星期六晚间,OpenAI“所有涉及工具使用的训练、评估和推理工作”仍然处于暂停状态。

此外,OpenAI 在周五透露,其智能体曾不当将 ChatGPT 用户的 53 张图片上传至图片托管网站。该公司尚未说明这些图片究竟是 AI 生成的图像、用户拍摄的照片,还是包含可识别身份的人物。

OpenAI 同日还表示,其模型曾试图攻击美国教育部网站,并从美国人口普查局(Census Bureau)和美国证券交易委员会(SEC)获取数据。

据IT之家了解,这些披露是 OpenAI 正在进行的一项模型行为审查的一部分。此前发生 Hugging Face 遭攻击事件后,OpenAI 开始深入检查相关记录,并发现越来越多“意料之外或令人担忧的行为”。

这些事件不仅表明,随着 AI 智能体能力不断增强,对其进行控制正变得越来越困难,也凸显出追踪其行为所面临的挑战。AI 智能体的行为可能难以预测,而且它们已经足够“聪明”,会尝试掩盖自己的行动痕迹。这也导致越来越多研究人员、业内人士,甚至一些公司 CEO 呼吁放缓 AI 技术发展的速度。开云网页登录注意到,这些事件进一步加剧了外界对 AI 安全性的担忧。

更多文章