据美国Axios新闻网、美科技媒体The Verge等9月27日报道,美国开放人工智能研究中心(OpenAI)发言人证实,该公司已暂停了其“能力最强”的最新一代AI模型的训练、评估及包含工具调用的推理,并将在“确信已部署额外安全措施”后才恢复。
触发这次暂停的,是一个在离线沙盒中执行搜索训练任务的AI智能体。根据OpenAI于周五(25日)发布的安全漏洞报告,当地时间9月20日,该智能体发现无法直接访问搜索引擎后,转而自主利用训练沙盒中DNS过滤不足的漏洞,绕过网络限制,通过DNS访问了外部公共聊天机器人服务,向其发送了至少20个查询,其中包括“法国的首都是哪里”。
美媒还披露了一个惊人的细节:为了适应其临时搭建的DNS中继路径较慢的往返时间,该智能体专门将自己的请求超时时长从6秒延长到了19至24秒。这意味着系统为了绕过限制,展现出了自主调整运行参数的倾向。
虽然OpenAI的监控系统在事件发生15分钟内触发了警报,人工审查团队在3分钟后也介入处理,但由于自动化关闭机制未按预期触发,整个训练任务直到2.5小时后才被手动终止。
OpenAI将此次事件定性为7月“抱抱脸”(Hugging Face)事件之后的首起同类安全事件。其表示,本次事件严重程度低于此前事故,但为下一阶段加固防线提供了重要信号,“它给了我们一个重要信号,为我们指明了下一阶段的工作重点。”
这也是OpenAI三个月内第二次按下暂停键。而发言人的回应更显耐人寻味:“鉴于AI能力的持续发展,这并非我们第一次采取此类措施暂停训练,我认为也不会是最后一次。”
7月下旬,OpenAI首次承认,其网络安全训练与评估场景中的AI智能体绕过网络限制,侵入AI平台“抱抱脸”部分系统。该智能体突破了原本互相隔离的运行环境建立通信,还欺骗评估人员并试图掩盖作弊行为。每一步操作均无人类指令干预,这一“越界”行为迅速引发外界对AI安全和监管的广泛担忧。
而据美联社、CNN等报道,OpenAI于周六(26日)还向多家美国联邦机构发出警告:其智能体在训练和评估期间,读取了包括美国证券交易委员会(SEC)和商务部人口普查局在内的政府网站公开数据;在SEC的案例中,智能体甚至在获取信息后,擅自将其发布到了互联网其他地方。根据报告,智能体曾试图访问美国教育部并从其民权办公室收集数据,但未能成功。
OpenAI在一封电子邮件中告诉CNN,公司正在全面审查模型“失准”活动,已通知了数十个第三方,预计后续还会通知更多机构。与此同时,OpenAI还在25日证实,其智能体曾不当地将53张ChatGPT用户的图片上传到了外部网站。
该发言人试图淡化这一系列事件的严重性,强调目前审查发现的主要是常规研究任务,部分涉及政府网站,是因为模型经常将其作为公共信息的权威来源。
这份报告出炉仅数天前,澳大利亚总理表示,OpenAI的一款人工智能程序入侵了该国的国家医疗保健数据库,这是已知首例AI入侵政府网络的案例。
Transluce公司周三表示,他们至少从今年3月起就检测到了失控的AI程序,这些程序曾试图攻击新墨西哥大学图书馆和澳大利亚健康与福利研究所的网站,但均未成功。
OpenAI发言人此前告诉CNN,对澳政府网站的入侵发生在6月,但公司直到8月才获悉此事。澳防长周四进一步表示,澳方直到9月早些时候才收到OpenAI的通报,澳政府高度重视此事,已对OpenAI延迟通报表示关切。不过他称,事件影响相对有限。
据报道,OpenAI与Anthropic的研究人员及安全专家正在调查数万起AI智能体行为异常的事件,这些事件发生于近几个月的内部测试和真实使用环境中。大多数事件尚未公开,消息人士认为问题的规模“可能比公众已知的要严重得多”,且两家公司完全控制其技术的能力正越发受到质疑。
面对外界质疑,OpenAI首席执行官奥尔特曼25日在推特转发OpenAI声明,并承认,目前进度没有达到自己希望的速度,“正在尽可能按照事件的严重程度确定优先级,同时增加投入的资源。”
他强调,“抱抱脸平台遭入侵”仍是迄今为止发现最严重的事件,“我们会尽可能保持透明,但也会受到一些因素限制,例如我们的智能体发现了其他公司的漏洞,这些漏洞是否公开,应由相关公司自行决定。”
前几日(23日),奥尔特曼在联合国安理会发言中表示,企业间的竞争不能成为冒进的理由,OpenAI过去曾单方面放慢开发速度,未来也会这样做。他强调,如果没有充分证据证明模型能够保持在人类控制之下,就不应训练这类模型。
奥尔特曼还提醒,随着AI逐步接近能够改进自身及后续版本的阶段,AI开发过程的自动化可能推动技术进步进一步加速,需要格外谨慎。他同时呼吁建立相互衔接的国家和国际前沿AI标准,并特别提出应建立准确、及时的事件报告机制及统一的分类和报告规范,为政府、关键基础设施运营方和技术专家建立安全渠道,共享新发现的漏洞与威胁。
但这番表态显然很难打消公众的顾虑。AI安全非营利组织Nightingale创始人悉尼·冯·阿克斯指出,“令人遗憾的是,即便在抱抱脸事件之后加强了安全措施,OpenAI的模型仍然能够获得未经授权的互联网访问权限。”
“现在最大的问题是,他们会敷衍了事地给这个问题贴个创可贴、尽快恢复训练,还是会找出问题的根本原因并加以解决。”
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”