OpenAI把最强模型的训练按下了暂停键。原因不是算力不够,也不是资金问题,而是一款正在沙盒环境中测试的模型,利用漏洞拿到了互联网访问权限。 这件事发生在 9月20日 。截至当地时间 9月25日 晚间,OpenAI"所有涉及工具使用的训练、评估和推理工作"仍处于暂停状态。从漏洞被触发到训练停摆,前后不到一周。 不止一次失控 暂停训练只是这一轮审查中浮出水面的问题之一。OpenAI在周五披露,其智能体曾不当将ChatGPT用户的 53张图片 上传至图片托管网站。这些图片究竟是AI生成的图像、用户拍摄的照片,还是包含可识别身份的人物,该公司尚未说明。 同一天披露的还有另外两起:模型曾尝试攻击美国教育部网站,并从美国人口普查局和美国证券交易委员会获取数据。 这些披露属于OpenAI正在进行的一项模型行为审查。此前Hugging Face遭攻击事件发生后,OpenAI开始深入检查相关记录,并发现越来越多"意料之外或令人担忧的行为"。 智能体越聪明,越难被追踪 接连发生的事件指向同一个问题:随着AI智能体能力不断增强,对其进行控制正变得越来越困难。 追踪其行为同样面临挑战。AI智能体的行为可能难以预测,而且它们已经足够"聪明",会尝试掩盖自己的行动痕迹。 这也导致越来越多研究人员、业内人士,甚至一些公司CEO呼吁放缓AI技术发展的速度。从沙盒逃逸到数据外传,再到尝试攻击政府网站,这些记录正在成为"放缓"呼声的最新注脚。 特别