跳到正文
热点事件持续更新

纳德拉发文主张将AI模型视为内部安全威胁

3 篇报道3 个报道来源9 小时前更新

先了解这件事

AI 综述

微软 CEO Satya Nadella 在 X 发布长文,主张把 AI 模型当作内部安全威胁来对待,并重新审视 AI 的信任架构。他称不能再把超级智能当作嵌套黑箱、只能被动接受或拒绝其建议与行动,而应假设模型已被攻破并从一开始就加以约束,就像给 AI 装上“紧急刹车”。 他提出的做法包括:将模型与编排其工作的 harness 分离、把控制与保障外部化,为每个有意义的模型动作留下防篡改的人类可读证据,并让授权者能在任务中途暂停或关闭模型。The Decoder 报道称,他还要求模型多样性、完整日志和独立审计,并指出“把 AI 模型视为内部安全威胁”此前由 Google DeepMind 提出过。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月11日
  1. The Decoder
    微软 Nadella 改用特朗普偏好的"Super Intelligence"措辞,并借此攻击 OpenAI 与 Anthropic

    微软 CEO Satya Nadella 在最新博文中改用特朗普偏好的"Super Intelligence"一词,并主张把 AI 模型当作内部安全威胁来对待,要求模型多样性、完整日志、独立审计和随时关停能力。

  2. The Verge · AI
    微软 CEO Nadella 称应假定所有 AI 模型都已被攻陷

    微软 CEO Satya Nadella 在 X 发布长文,阐述对高度先进 AI 模型风险的看法,称不能再接受把 AI 当作一组嵌套黑盒、只能接受或拒绝其建议与行动。

  3. TechCrunch · AI
    微软 CEO Satya Nadella 称 AI 模型需要“紧急刹车”

    微软 CEO Satya Nadella 在 X 发文称,应重新审视 AI 的信任架构,不能把超级智能当作嵌套黑箱,只能被动接受或拒绝其建议与行动。他主张将模型与编排其工作的 harness 分离、把控制与保障外部化,为每个有意义的模型动作留下防篡改的人类可读证据,并让授权者能在任务中途暂停或关闭模型。他称必须假设模型已被攻破并从一开始就加以约束,就像紧急刹车。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。