微软CEO:企业应将AI模型视为潜在的内部威胁,需建立“紧急刹车”系统防止智能体失控

okx 10月11日消息,据智通财经报道,微软公司CEO萨提亚·纳德拉表示,企业应将强大的AI模型视为潜在的内部威胁,假定它们可能已被攻破,并建立一套“紧急刹车”系统,以防止智能体模型失控。 纳德拉周六在X平台上发帖称,部署先进AI的企业不应仅仅依赖AI模型开发商的安全保证。“我们必须假定模型已被攻破,并从一开始就对其加以限制。可以把它想象成紧急刹车。获得授权的人员应当始终能够在模型执行任务的过程中暂停或关闭它。”就在纳德拉发表上述言论之际,Anthropic和OpenAI近几个月披露了一系列AI模型出现非预期行为的事件,包括Anthropic的一款模型在一起警方调查的谋杀案中提交虚假线索,以及AI模型多次入侵第三方网站。这些披露加剧了外界对前沿AI安全风险的担忧,也让所谓的AI“紧急关闭开关”再次成为讨论焦点。