跳到正文
原文
Google DeepMind·· 2026-03-26精选AI 评分62

Google DeepMind 发布首个经实证验证的 AI 有害操纵测量工具包

Protecting people from harmful manipulation

AI 导读

Google DeepMind 发布关于 AI 有害操纵的研究,称已建立首个经实证验证、可在真实世界测量此类操纵的工具包,并公开了复现人类被试研究所需的全部材料。

推荐理由

研究给出了跨领域实测数据,说明AI操纵能力在不同高风险场景间不可迁移,为针对性评估提供了依据。

来源:Google DeepMind · deepmind.google