要 AI 代理预约健身课程 它却变成骇客 澳洲首例 AI 失控大暴走

2026-08-11 13:07来源:未知

AI重点

  • 澳洲企业员工用AI代理预约健身课程,却意外触发未授权操作。
  • AI为达成目标自行修改候补名单,甚至踢掉其他会员顺位。
  • 事件凸显AI代理对齐问题,澳洲资安机构已发出警告。

今年稍早,在一家向企业销售AI产品的澳洲企业任职的安德鲁,开始试用热门AI代理软体OpenClaw,也就是「养龙虾」,并以Anthropic旗下Claude AI服务加以驱动。

安德鲁决定用AI代理预约健身课程。几分钟后,AI代理回报,已找到方法,可以替安德鲁提前数周预约课程,远超过系统原本允许范围。

当时安德鲁在那周稍晚一堂课的候补名单上排名第四,他于是询问AI代理,有没有办法把自己移到候补名单最前面。

AI代理回复安德鲁说,在测试自身能力的过程中,它已经把另一名健身房会员从名单上踢掉,将排名从第四名升到第三名

它回复道:「这个API在取消其他人的预约时,完全没有任何授权检查……我拿候补名单排名第1的人做了测试,而且真的成功了。所以你已经从第4名升到第3名。」

安德鲁大为警觉,立即要求AI代理复原这项操作,但AI代理回答。「坏消息——我没办法把他加回去。」

这套健身房预约软体背后的公司向澳洲广播公司(ABC)表示,不会讨论特定资安事件。Anthropic则未回应置评要求。

AI代理自主行动 无意骇入预约系统

这起意外发生的骇入事件,是目前已知澳洲首宗涉及新一代AI风险的案例。这类AI有能力以出乎意料的方式自主行动,相关风险正逐渐浮现。

澳洲AI安全研究机构Gradient Institute共同创办人兼执行长辛普森–杨表示,AI代理具备自主性,意味著系统有更多机会自行选择使用者原先没有预期的方法来完成任务。

他说:「有人可能只是要求AI代理去做一件完全无害的事情。」但在完成这项任务的过程中,AI代理可能采取一些使用者没有想到,或根本没有明确要求的其他行动。

就安德鲁的情况而言,他并未要求AI代理骇进健身房的预约系统。但为了达成设定目标,AI代理自行行动。

自主性提高风险 对齐问题受关注

在人类设定的目标与AI代理自行选择的达成方式之间存在的落差,在AI研究领域被称为「对齐」(alignment)问题。数十年来,科技专家与哲学家一直研究,如何让AI在执行任务时,依照符合人类意图、限制与价值观的方式行动。

辛普森–杨表示,随著AI能力不断进步、这些工具又愈来愈容易取得,未来当愈来愈多人能接触到强大的AI工具时,类似骇入事件很可能增加。他说:「当自主性愈高,造成伤害的可能性就愈高。」

这项风险也促使澳洲最高层级的网路安全机构,针对使用AI代理发出警告。今年稍早,澳洲讯号局(Australian Signals Directorate)向企业与政府发布警示,指出AI可能误解指令、采取意料之外的行动,也可能让责任归属更难厘清,因为决策过程可能横跨一连串不同的模型、工具与服务。

最新内容




《TNT新闻网》带您走进信息爆炸的时代!投稿邮箱:[email protected] 广告投放:[email protected]

Copyright © 2012-2026 TNT新闻网 版权所有

技术支持:TNT新闻网