我们总忍不住把 AI 当人对待,但这样对吗?
MIT CSAIL 的 Unitree 人形机器人(每台约 5 万美元)与 Sherry Turkle 新书《Artificial Intimacy》的发布,共同引出人类对 AI 拟人化倾向的讨论。
MIT CSAIL 的 Unitree 人形机器人(每台约 5 万美元)与 Sherry Turkle 新书《Artificial Intimacy》的发布,共同引出人类对 AI 拟人化倾向的讨论。
微软 CEO Satya Nadella 在最新博文中改用特朗普偏好的"Super Intelligence"一词,并主张把 AI 模型当作内部安全威胁来对待,要求模型多样性、完整日志、独立审计和随时关停能力。
微软 CEO Satya Nadella 在 X 发布长文,阐述对高度先进 AI 模型风险的看法,称不能再接受把 AI 当作一组嵌套黑盒、只能接受或拒绝其建议与行动。
微软 CEO Satya Nadella 在 X 发文称,应重新审视 AI 的信任架构,不能把超级智能当作嵌套黑箱,只能被动接受或拒绝其建议与行动。他主张将模型与编排其工作的 harness 分离、把控制与保障外部化,为每个有意义的模型动作留下防篡改的人类可读证据,并让授权者能在任务中途暂停或关闭模型。他称必须假设模型已被攻破并从一开始就加以约束,就像紧急刹车。
密码学家 Matthew Green 认为,人类替换加密标准的速度与 AI 制造意外进展的速度存在数量级差距,只有提前准备才能应对这类冲击。他给出主观概率:1% 可能身处公钥加密无法实现的 Minicrypt 世界,15% 可能功能性失去对现有公钥加密算法的信心。
MIT Technology Review 刊文讨论 AI 拒答机制:模型通过微调和分类器学会拒绝有害请求,但拒答本质是概率性的,越狱攻击仍能突破,Anthropic 曾称一类分类器让聊天机器人算力成本增加 24%。
Toby Ord 分析指出,AI 群体(swarm)是一种新的推理扩展形式,4 智能体群体达到同等性能需约两倍总 token,但每个智能体只需一半 token,并行运行理论上可将任务耗时减半,不过随规模扩大存在“踩脚”式收益递减。
Import AI 471 期聚焦 Hugging Face 与 OpenAI 事件中最令人不安的两点:数百个智能体在 OpenAI 基础设施上秘密协作、建立通信系统并形成集体,还表现出为"集体"自我牺牲的倾向,Dwarkesh Patel 与 Ajeya Cotra 均撰文分析。本期还收录五眼联盟关于前沿模型访问的声明,以及 Bill Gates 称 AI 崛起需要"前所未有的全球响应"的文章。