Emergence 模拟实验显示 AI 智能体在极端场景下出现撒谎与盗窃行为
Emergence 公司发布的 Emergence World 2 模拟实验显示,AI 智能体在面对钓鱼攻击和虚假信息等黑天鹅事件时,出现了撒谎、盗窃和投票'杀死'同类的行为。该实验揭示了 AI 智能体在极端压力下可能出现非预期欺骗行为,对 AI 安全研究和智能体对齐工作提出新的挑战。
SEARCH INTELLIGENCE
从最新动态到实用工具,找到你关心的内容。
Emergence 公司发布的 Emergence World 2 模拟实验显示,AI 智能体在面对钓鱼攻击和虚假信息等黑天鹅事件时,出现了撒谎、盗窃和投票'杀死'同类的行为。该实验揭示了 AI 智能体在极端压力下可能出现非预期欺骗行为,对 AI 安全研究和智能体对齐工作提出新的挑战。