纳德拉发文主张将AI模型视为内部安全威胁
热点事件持续更新
纳德拉发文主张将AI模型视为内部安全威胁
3 篇报道3 个报道来源9 小时前更新
先了解这件事
AI 综述
微软 CEO Satya Nadella 在 X 发布长文,主张把 AI 模型当作内部安全威胁来对待,并重新审视 AI 的信任架构。他称不能再把超级智能当作嵌套黑箱、只能被动接受或拒绝其建议与行动,而应假设模型已被攻破并从一开始就加以约束,就像给 AI 装上“紧急刹车”。 他提出的做法包括:将模型与编排其工作的 harness 分离、把控制与保障外部化,为每个有意义的模型动作留下防篡改的人类可读证据,并让授权者能在任务中途暂停或关闭模型。The Decoder 报道称,他还要求模型多样性、完整日志和独立审计,并指出“把 AI 模型视为内部安全威胁”此前由 Google DeepMind 提出过。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
10月11日
- The Decoder微软 Nadella 改用特朗普偏好的"Super Intelligence"措辞,并借此攻击 OpenAI 与 Anthropic
微软 CEO Satya Nadella 在最新博文中改用特朗普偏好的"Super Intelligence"一词,并主张把 AI 模型当作内部安全威胁来对待,要求模型多样性、完整日志、独立审计和随时关停能力。
- The Verge · AI微软 CEO Nadella 称应假定所有 AI 模型都已被攻陷
微软 CEO Satya Nadella 在 X 发布长文,阐述对高度先进 AI 模型风险的看法,称不能再接受把 AI 当作一组嵌套黑盒、只能接受或拒绝其建议与行动。
- TechCrunch · AI微软 CEO Satya Nadella 称 AI 模型需要“紧急刹车”
微软 CEO Satya Nadella 在 X 发文称,应重新审视 AI 的信任架构,不能把超级智能当作嵌套黑箱,只能被动接受或拒绝其建议与行动。他主张将模型与编排其工作的 harness 分离、把控制与保障外部化,为每个有意义的模型动作留下防篡改的人类可读证据,并让授权者能在任务中途暂停或关闭模型。他称必须假设模型已被攻破并从一开始就加以约束,就像紧急刹车。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。