🤖
🤖
核心导读
微软 CEO 纳德拉提出,AI 安全需要“紧急刹车”式设计:将模型与调度其工作的系统分离,外部化控制与保障,为关键动作留存防篡改、人类可读证据,并确保授权人员能在任务中途暂停或关闭模型。他还主张默认模型可能已被攻陷,须从一开始就遏制。此番表态正值多家 AI 公司承认更多失控事件,Anthropic CEO 也公布了更审慎的开发计划。
微软 CEO 萨提亚·纳德拉成为最新一位就如何改进 AI 安全发表长篇思考的科技高管。
周六上午,纳德拉在 X 上发帖写道,现在“是时候退后一步,评估 AI 的信任架构”了。
“我们不能把超级智能当作一组嵌套的黑箱,只是简单地接受或拒绝它的建议、回答和行动。”纳德拉写道,这里使用了特朗普政府对 AI 的首选称呼。
按照纳德拉的设想,这种方法“意味着将模型与调度其工作的外挂系统分离”,同时“将控制与保障措施外部化”。他还呼吁,对“每一个有意义的模型动作”都要以“防篡改、人类可读的证据”记录下来,并建立这样的系统:始终让“获授权人员”有能力“在任务执行中途暂停或关闭模型”。
“我们必须假设模型已遭入侵,并从一开始就将其遏制。”他说,“把它想象成紧急刹车。”
纳德拉发表上述言论之际,领先的 AI 公司承认,越来越多事件显示它们似乎失去了对模型的控制;此前,Anthropic CEO 达里奥·阿莫代伊也公布了一项更谨慎的 AI 开发计划。
上一篇
苹果披露与个性化播客初创公司Huxe达成团队聘用及技术授权协议
下一篇
这已是最新的一篇资讯
分享这篇文章: