萨蒂亚·纳德拉:应当假设所有 AI 模型都已失陷

编辑部 · 发布 2026/10/10 · 更新 2026/10/11

萨蒂亚·纳德拉:应当假设所有 AI 模型都已失陷

微软首席执行官在 X 上发布长文,阐述了高度先进的 AI 模型带来的危险,以及如何应对这些风险。纳德拉表示,我们不能再接受把 AI 当成“一组嵌套的黑箱”、只是接受或拒绝其建议与行动的状况。他呼吁建立更加透明的系统,让模型受到约束、能够被观察,并留下“防篡改、可供人类阅读的证据”。

STK178_Satya_Nadella_B

微软首席执行官在 X 上发布长文,阐述了高度先进的 AI 模型带来的危险,以及如何应对这些风险。纳德拉表示,我们不能再接受把 AI 当成“一组嵌套的黑箱”、只是接受或拒绝其建议与行动的状况。他呼吁建立更加透明的系统,让模型受到约束、能够被观察,并留下“防篡改、可供人类阅读的证据”。

他的许多建议与业内其他人的观点一致:及时披露事件、开展独立审计、提供可验证的数据,以及约束模型。在最后一点上,他似乎比该领域的一些同行走得更远。他说:

我们必须假设模型已经失陷,并从一开始就对其加以约束。可以把它想成紧急制动装置。获得授权的人员应当始终能够在模型执行任务的过程中暂停或关闭它。更先进的模型将需要更先进的约束技术,而我们需要为这些技术制定统一标准。

遗憾的是,纳德拉在整篇文章中还一直把 AI 称为“超级智能”。

来源:Theverge

Related Articles

继续阅读相关文章

微软纳德拉:AI 模型需要“紧急制动装置”
新闻

微软首席执行官萨蒂亚·纳德拉是最新一位就如何提高 AI 安全性发表长篇观点的科技公司高管。 纳德拉在周六早上发布的 X 帖子中写道,现在是时候“退后一步,评估 AI 的信任架构”了。

Topics & FAQ

相关专题与 FAQ

暂无内容