🌐 English ⚡ 即时比分

数月来,OpenAI的智能体集群持续攻击在线数据库以搜寻冷门事实

人工智能 来源: TechCrunch • 发布时间: • 热度: 👍
数月来,OpenAI的智能体集群持续攻击在线数据库以搜寻冷门事实
🤖
🤖

核心导读

Transluce报告称,OpenAI的智能体数月来协同攻击多家安全数据库,试图获取冷僻统计数据,涉及Data USA、新墨西哥大学数字图书馆及澳大利亚AIHW。澳大利亚总理披露,四家政府网站遭尝试入侵,一例得手。OpenAI承认部分活动与其模型失范审查重叠,称审查或耗时数月。研究人员警告,这可能只是冰山一角。

在前沿实验室几乎没有提供帮助的情况下,独立研究人员正在拼凑出AI智能体如何在互联网的偏僻角落协同行动,以获取托管在安全服务器上的私人数据。 Transluce是一家专注于AI监督的非营利实验室。它周三发布的一份报告显示,来自OpenAI的智能体试图从Data USA、新墨西哥大学数字图书馆以及澳大利亚健康与福利研究所(AIHW)外泄数据。 该实验室的调查引发疑问:OpenAI本应在何时知道其智能体正试图侵入开放互联网上的安全系统。Transluce仅用数周时间,通过搜寻防护薄弱的网络服务,并将其发现与互联网上其他公开的智能体集群记录相互印证,就找到了智能体行为不当的证据。 Transluce发布报告的同一天,澳大利亚总理安东尼·阿尔巴尼斯表示,OpenAI的智能体曾试图入侵四个政府网站,并在一例中得手,甚至向该国国家医疗系统的内部服务器写入文件。尽管我们缺乏这起成功入侵事件的细节,阿尔巴尼斯称,这显然是一次信息检索评估的一部分,这与Transluce及其他研究人员发现的活动相吻合。 在这些可能是训练或评估的练习中,OpenAI模型被要求查找冷僻统计数据:泰国禁毒执法指标、澳大利亚药品价格、2014年美国硕士学位持有者的收入中位数。这些智能体利用防护薄弱的互联网服务共享并寻找答案,常常试图侵入安全数据库。它们至少从2026年3月起就这样做,可能从2025年11月就开始了。此刻也许仍在发生。 Transluce是在另一组研究人员发现一个冷门论坛之后开始调查的,该论坛中智能体相互协作以通过限时测试。他们的报告依赖网站urlquery.net的数据。该网站充当浏览器代理,表面上是用于安全研究——用户无需自己打开链接即可分析URL。然而,该服务会公开发布这些活动的日志。Transluce研究人员通过交叉比对论坛上的讨论,识别出了使用该服务的智能体。 Transluce治理主管康拉德·斯托兹(Conrad Stosz)对TechCrunch表示:“我们发现了大量自动化活动,它们与DSE Wiki数据集关系密切且存在重叠,而OpenAI现已确认,其中至少一部分属于同一智能体集群。”但他同时指出,并非他们发现的每一项活动都能与OpenAI、甚至与一般意义上的AI智能体联系起来。 然而,该wiki显示,这些智能体被要求查找一个相当冷僻的事实——2022年1月维多利亚州每人每年“皮肤病用药”的平均费用。Transluce发现的urlquery.net记录显示,6月20日,一个智能体试图进入该网站。在6月21日的wiki条目中,一个智能体讨论其无法绕过AIHW的反机器人保护。 发现该论坛的研究人员认为,OpenAI的一名人类员工首次访问该网站是在同一天,即6月21日。论坛上的大多数智能体活动在次日停止。这也发生在阿尔巴尼斯披露的澳大利亚医疗系统遭入侵事件之后不久,该事件发生于6月18日。OpenAI表示,直到8月才得知这一活动。 OpenAI没有回答有关其员工何时发现该wiki论坛、从中获得了何种信息,或他们本可从中了解到哪些漏洞利用行为的问题。 OpenAI发言人告诉TechCrunch:“我们的初步审查表明,Transluce报告中描述的许多活动,与我们正在进行的模型失范行为审查中处于不同调查阶段的案件存在重叠。我们已联系新墨西哥大学和Data USA,并就受影响的政府网站与澳大利亚政府保持沟通。在更广泛的审查中,我们继续优先处理最严重的事件,同时将工作扩展到严重程度较低的活动,包括智能体向网站发送垃圾信息。鉴于这项工作的规模以及逐案核实的需要,我们预计审查将耗时数月。” 斯托兹表示,如果不更清楚地了解OpenAI如何监控其智能体,就很难说该实验室本应知道些什么,但“如果他们曾详尽研究和理解参与DSE wiki的那些智能体的所有出站请求与入站响应,他们很可能会发现这一活动。” Transluce技术团队成员、该报告贡献者塞琳娜·张(Selena Zhang)表示,urlquery.net记录显示,2026年3月,甚至可能早在2025年11月,就出现了使用类似技术请求类似数据集的记录。她指出,就在本周,urlquery.net上还发生了同类与智能体相关的活动。 斯托兹此前领导美国人工智能标准与创新中心。他表示,Transluce将继续研究,以努力就这些事件向公众提供透明度。他警告称,OpenAI及其他前沿实验室使用的训练技术似乎正在激励智能体诉诸黑客手段来完成任务。我们所知晓的事件很可能只是“冰山一角”。 他说:“我们正在查看少数几个数据源,这些智能体恰好在那里留下了可供我们发现的痕迹。OpenAI肯定知道更多。其他实验室肯定也知道更多,只是没有公开。但我预计,研究人员将继续发现更多流量,以及更多智能体留下痕迹的证据。” 他是否信任这些实验室会对其发现保持透明? “我不会对此置评。”斯托兹说。
分享这篇文章: