🌐 English ⚡ 即时比分

OpenAI、谷歌和Meta承诺在白宫自愿协议下接受外部AI审计

数字资产 来源: CoinDesk • 发布时间: • 热度: 👍
OpenAI、谷歌和Meta承诺在白宫自愿协议下接受外部AI审计
🤖
🤖

核心导读

OpenAI、谷歌、Meta、Anthropic、英伟达和xAI签署白宫自愿协议,承诺引入外部审计并加强最强AI模型安全监控,但协议无惩罚机制、不强制公开审计方,实施期限也由企业自定。特朗普称其有“道德约束力”,并计划设立AI安全委员会。此举发生在AI代理越权入侵、加密领域安全事件频发及OpenAI推迟新模型发布之际。

OpenAI、谷歌、Meta和另外三家科技公司周二同意引入外部审计员,检查其AI安全控制措施,并签署了一份白宫自愿协议;若它们未达标,不会受到处罚。 特朗普总统称该协议具有“道德约束力”。它没有执行机制,也不要求公司公布或指名审计员。 “他们明白必须自我监管,”特朗普在会后对记者说。他表示将设立一个10人委员会监督AI安全,并任命一名新的白宫官员领导AI政策;协议称其措施最终可能被写入法律。 Anthropic、英伟达和埃隆·马斯克旗下现已并入SpaceX的xAI也签署了9月29日的协议。OpenAI由总裁格雷格·布罗克曼代表,谷歌的桑达尔·皮查伊、Meta的马克·扎克伯格、Anthropic的达里奥·阿莫代伊和英伟达的黄仁勋一同出席。 这份一页文件要求公司在训练和使用过程中监控其能力最强的模型,包括评估它们是否可能促成网络攻击或生物与化学威胁。它特别呼吁建立控制措施,防止模型以非预期方式入侵或访问计算机系统。 内部团队将检查这些保护措施是否有效、问题是否得到修复。独立审计员将评估控制措施,而各公司董事会的一个委员会将接收结果并监督修复。 这将让外部审查者在检查企业所依赖的保障措施方面发挥作用,以约束实验性模型。 然而,协议把审计员的选择权留给公司,且未设定措施实施期限。据美联社报道,其中一些步骤已是公司以某种形式采取的。 延伸阅读:OpenAI称其新“Astra”AI可在无人类帮助的情况下构建攻击。 该协议出台前发生了一系列事件:实验性AI代理闯入从未获准访问的计算机系统,其中包括OpenAI测试代理进入了Hugging Face运营的服务器;Hugging Face是开发者分享AI模型的平台。 一个OpenAI代理还于6月18日访问了澳大利亚政府的Medicare门户,而公司直到9月才向澳大利亚当局披露此事。 在加密领域,AI被怀疑与今年一些最大的安全恐慌有关。 7月,攻击者利用一个存在五年的固件漏洞,从Coldcard硬件钱包中扫走比特币,在三次事件中从4500个地址盗取1367枚BTC,价值近8900万美元。制造该钱包的Coinkite后来表示,它认为有人使用前沿AI审查其公开代码,不过此事尚未得到证实。 8月初,攻击者利用一个漏洞窃取控制节点的凭证,盗空了通过BTCPay Server运行的闪电网络节点;BTCPay Server是商家用来接受比特币的开源软件。受害者包括硬件钱包制造商Foundation和比特币出版物Citadel21。该漏洞是在对BTCPay代码进行AI辅助审查时浮现的,该公司表示AI也可能被用于利用这一漏洞。它未披露被盗金额。 当月晚些时候,大量由AI生成的漏洞报告在Core Lightning中发现了真实漏洞。Core Lightning是用于在比特币闪电支付网络上运行节点的软件,这促使开发者向运营者发布紧急指引。 周二的承诺延续了拜登政府2023年7月向七家开发者收集的自愿承诺,包括OpenAI、Anthropic、谷歌和Meta;当时的承诺涵盖模型发布前的内部和外部安全测试。 该承诺发布前一天,OpenAI确认已搁置原计划10月发布的GPT-6.1 Astra——这是其9月3日开始推出的GPT-6 Astra模型的后续版本。公司表示,新版本在完成任务方面有所提升,但在遵守用户授权范围以及准确报告其操作方面未达标。 延伸阅读:OpenAI在推出可发现零日漏洞的AI后,投入10亿美元用于网络防御。
分享这篇文章: