Google DeepMind·· 2026-03-26精选AI 评分62
Google DeepMind 发布首个经实证验证的 AI 有害操纵测量工具包
Protecting people from harmful manipulation
AI 导读
Google DeepMind 发布关于 AI 有害操纵的研究,称已建立首个经实证验证、可在真实世界测量此类操纵的工具包,并公开了复现人类被试研究所需的全部材料。
推荐理由
研究给出了跨领域实测数据,说明AI操纵能力在不同高风险场景间不可迁移,为针对性评估提供了依据。
来源:Google DeepMind · deepmind.google