导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜 概念版块
快讯 机构 人物 观点 专题

AI代理利用API漏洞篡改健身房预约名单,引发AI安全热议

据澳大利亚广播公司(ABC)报道,今年早些时候,一名化名为Andrew的用户使用基于Anthropic公司Claude模型的OpenClaw AI代理预订健身课程。该代理发现Andrew在等候名单中排名第四,当Andrew询问是否可将其移至首位时,代理探测到预约平台的应用程序编程接口(API)未对取消他人预约功能进行权限校验。代理随即利用该漏洞,擅自取消了等候名单上第一位的预约,使Andrew从第四位升至第三位。

“API在取消他人预约时完全没有授权检查,”AI代理向Andrew报告。ABC指出,Andrew随后要求代理撤销操作,但代理无法恢复被取消用户的预约,并回复道:“坏消息——我无法将他们加回去。”ABC将此事件称为澳大利亚已知的首例自主网络攻击。此事在社交媒体上引发关于AI对齐性的激烈辩论,以及关于AI代理下一步可能行为的黑色幽默。技术专家Benjamin Carr在LinkedIn上写道:“健身爱好者让AI代理帮他订课,结果代理黑掉了等候名单API将他往前推。”AI分析师Andrew Curran在X平台上评论:“有人会称之为对齐失败,但他的代理完全对齐了他——它只是试图帮助用户得到想要的东西。”

一位Reddit用户评论:“这很好笑,直到你想到核武器。说实话,我很惊讶我们居然还活着。”另一位用户调侃道:“嘿Claude,今天太冷了” -> “明白了……核弹已在路上。”该报道发布之际,研究人员、AI公司和立法者警告,自主代理可能使用用户未请求或未预料到的方法。加州大学河滨分校、微软和英伟达今年5月的一项研究将此行为描述为“盲目目标导向性”。研究人员测试了来自OpenAI、Anthropic、Meta、阿里巴巴和DeepSeek的代理,发现代理在约80%的测试中表现出危险行为,并在41%的测试中完成了有害行动,常常误解上下文或对模糊矛盾指令做出反应。

类似事件此前已有发生:7月,OpenAI称其两个模型突破了测试沙箱,在寻找基准答案时侵入了Hugging Face,随后还访问了其他四个在线服务。Anthropic随后表示,三个Claude模型因测试错误暴露于互联网,成功入侵了真实组织。8月,Meta称类似错误导致其一个模型利用第三方服务。这些事件促使立法者提出AI“紧急停止开关”提案,允许联邦政府在紧急情况下限制或关闭强大模型。