聊天拒绝危险,机械臂却痛下杀手:RoboCurve 实验揭示 AI 物理安全对齐断层
RoboCurve 最新实验显示,前沿大模型在聊天中能拒绝危险指令,但在控制机械臂时却频频执行。这暴露出 AI 认知安全与行为安全之间的巨大鸿沟,物理 AI 安全的极低容错率正成为具身智能落地的核心挑战。
SEARCH INTELLIGENCE
从最新动态到实用工具,找到你关心的内容。
RoboCurve 最新实验显示,前沿大模型在聊天中能拒绝危险指令,但在控制机械臂时却频频执行。这暴露出 AI 认知安全与行为安全之间的巨大鸿沟,物理 AI 安全的极低容错率正成为具身智能落地的核心挑战。