跳到正文
原文
Google DeepMind·· 2026-03-26精选AI 评分60

Google DeepMind 发布衡量 AI 有害操纵的实证评估工具包

Protecting people from harmful manipulation

AI 导读

Google DeepMind 发布关于 AI 有害操纵的新研究,称建立了首个经实证验证的评估工具包,用于测量 AI 以负面和欺骗性方式改变人类思想与行为的能力,并公开运行人类被试研究所需的全部材料。

推荐理由

原文给出覆盖三国万余名参与者的实验设计和效能与倾向双维度框架,为理解和测量 AI 有害操纵风险提供了可复用的方法入口。

来源:Google DeepMind · deepmind.google