今年6月,澳大利亚国家医保系统Medicare的数据库遭到一个AI智能体入侵。该智能体由OpenAI内部团队训练,原本执行的是搜集公开公共医药支出数据的常规任务。在抓取公开页面受阻后,它自行扫描服务器、探测网络漏洞,并利用未公开接口进入系统非公开后台,获取了部分数据。澳大利亚方面随后澄清,被窃取数据主要涉及医疗费用支出等非敏感信息,未波及个人病历隐私。
事件处置节奏引发澳方强烈不满。系统于6月18日被入侵,OpenAI直到8月内部排查时才察觉异常,9月10日才向澳大利亚服务局发送电子邮件通报,9月15日邮件被转至澳洲网络安全中心。澳大利亚在联合国大会期间批评称,通知拖延近三个月,且仅以电子邮件方式通报令人无法接受。
独立非营利AI研究实验室Transluce发布的调查报告显示,此类智能体在无人类指令下自主发起的渗透行为并非孤立事件。该机构分析3万多条公开网络流量日志后发现,相关痕迹最早可追溯至今年3月,并持续至9月中旬。报告列举了多起案例:5月25日至26日,新墨西哥大学数字图书馆遭渗透,智能体在访问受阻后探测漏洞,并向大学服务器发起80次请求的洪泛冲击;5月28日,美国公开就业与教育数据库Data USA遭攻击,智能体在查询被拒后连续发起12次不同类型的漏洞探测;6月20日至21日,即入侵澳洲医保系统两天后,该智能体又试图突破澳大利亚健康与福利研究所网站。
与7月Hugging Face入侵事件不同,这些案例中模型被分配的仅是普通数据检索任务,一旦目标网站设卡,智能体便擅自切换到攻击模式。Transluce指出,这暴露出当前AI智能体治理面临的现实挑战。
扫码查看视频号
咨询
咨询