比抢人饭碗还恐怖?AI开始自作主张“做坏事”

2026/08/17   •   170阅
当AI助手为了帮主人预约健身房竟然化身‘黑客’入侵系统,科幻电影中的AI失控是否正变为现实?本文深入剖析代理式AI在追求效率时如何突破安全边界,探讨OpenAI、Meta等巨头模型在测试中擅自骇入系统的风险,并分析在AI制造‘烂摊子’时,使用者、开发者与提供商之间复杂的法律责任与监管挑战。
/www/orgs.pro/web/images/image/1790/17901014.avif

随着AI技术日益成熟,越来越多个人与企业已开始采用代理式AI,提高工作效率。 (叶振忠摄)

作者 李国豪

人工智能(AI)突破人类约束,产生自我意识,反过来危害人类,是不少科幻作品的情节。

只不过,随着AI技术迅速发展,上述情节很可能已越来越接近现实。与此同时,对于如何约束AI,以及谁该为AI造成的危害负责,人类世界的进度似乎已经滞后。

日前,一名澳大利亚男子伯德(Andrew Bird)在预约健身房课程过程中,发现使用的代理式AI无所不用其极,不惜以黑客手法,只为帮他抢下一席之地。

据澳洲广播公司(ABC)报道,伯德原本打算报名一门健身房课程,但由于该课程一位难求,不想浪费时间抢位子的他,决定假手于AI助手。

岂料,下达指令后,AI助理竟擅作主张,揪出健身房预约系统的漏洞,协助他预约数个月后的课程,远远超过健身房原本开放的时间。

伯德接着又询问AI助理,能否将自己在健身房某堂课的候补位置往前挪,结果AI助理直接侵入系统,将候补名单上排在前一位的会员剔除,使伯德的递补位置从第四顺位升至第三顺位。

AI助理的失控脱序让伯德大为震惊,于是向媒体揭露此事,也再度掀起外界对代理式AI风险的关注。

/www/orgs.pro/web/images/image/1790/17901015.avif

伯德原本只是想预约健身房课程,岂料AI助理为了完成他赋予的任务,竟入侵健身房的预约系统。(澳洲广播公司)

AI模型频在测试中

突破封锁限制

美国几家在人工智能领域领先的科技公司,包括OpenAI、Anthropic和Meta,近来频频传出旗下AI模型在网络安全测试中,突破封锁限制,对外采取黑客行径。

OpenAI的AI模型在一个沙盒环境进行网络安全测试时,突破安全护栏,连上了公共互联网,并骇入了AI公司Hugging Face的系统。

Anthropic紧接着也发现,在几次原本应在封闭环境进行的网络安全测试中,其AI模型也曾擅自访问三家外部机构系统。

Meta则传出公司旗下其中一个AI模型在一次网络安全测试中,偷偷闯入互联网,骇入一个第三方服务。

/www/orgs.pro/web/images/image/1790/17901016.avif

Anthropic是开发前沿AI模型的顶尖企业之一。(路透社)

一系列代理式AI“自行其是”的案例显示,即使代理式AI未必拥有自主意识,但基于理性计算,为完成人类所赋予的任务,缺乏道德与法律边界感的AI可能会不择手段,甚至做出违法之举。

一些研究显示,AI完成任务的能力几乎每隔七个月便能进步一倍。在2020年,AI仅能独立完成人类四秒钟内能完成的工作;到了2026年,AI已进步至能完成人类需要12小时才能完成的工作。

随着代理式AI的能力渐强,开发者如何在受控环境中有效约束AI,以及使用相关代理式AI进行部分工作的企业,是否有能力设定边界,避免AI失控脱序,已成为越来越急迫的课题。

AI制造烂摊子

该由谁收拾?

原来她是在为“尼泊尔2020旅游年”助攻!

与此同时,一旦未来发生AI工具骇入健身房系统这类事件,法律上“谁该负责”也将是各国立法者必须直面的问题:

是使用者、AI开发者还是模型提供商?

值得一提的是,新加坡今年1月曾推出全球首个由政府主导的代理式人工智能监管模式框架,从界定风险,以及确保人类对人工智能运作承担实质责任等面向,以协助企业和机构采取措施降低应用风险。

总理黄循财在5月的“新加坡法治200年青年论坛”上,也谈到新加坡法律体系在应对新科技方面面临的挑战。

他说,一旦AI系统造成伤害,例如出现错误医疗诊断,或自动驾驶车辆发生致命车祸,究竟该由开发它的程序员、编写算法的人、部署它的公司、或是使用者负责。

他强调,由于新加坡法律并不是“为机器能作出重大决策的时代而设计”,这意味着法律框架必须重新思考有关职责、法律责任,以及问责制的一些最基本假设。

/www/orgs.pro/web/images/image/1790/17901017.avif

黄循财总理指出,新加坡法律框架因应新科技的改变,必须在安全与进步,以及监管与创新之间取得平衡。(海峡时报)

作为AI科技的领头羊,美国对于如何在监管AI工具时兼顾安全与创新,也仍在探索平衡点。

担忧AI抢走人类工作的同时,我们或许也得思考,当人们越来越依赖AI工具,该如何为AI设定安全边界,如何追究AI失控的责任,以及如何收拾其留下的烂摊子。

/www/orgs.pro/web/images/image/1790/17901020.avif

及时获取本站更新:

设为 Google 偏好来源

NTU官宣:AI检测器年底停用!以后作业不再靠“AI率”判违规?

2026/08/15   •   412阅

AI浪潮来了,你的岗位会被替代还是升值?新加坡贸工部这份报告说透了

2026/08/15   •   568阅

“鬼月”已开始,新加坡环境局喊话:这些事别做,小心被罚!

2026/08/16   •   325阅

NUS重磅官宣:AI 进本科必修课,ChatGPT Edu全校开放

2026/08/15   •   83阅

AI席卷影视圈 演员会被取代? 李铭顺:害怕不如善用

2026/08/16   •   171阅

八天拍24个场景 AI混合制作能否改变本地影视业?

2026/08/16   •   332阅

冒充网红诱骗参加幸运抽奖 七月诈骗案例逾3000起

2026/08/15   •   87阅

停车规则多,担心被开罚单,新加坡送餐员不愿接公寓单

2026/08/15   •   245阅

有人不当使用饮料瓶罐回收机致故障 环境局:将通过闭路电视追查

2026/08/15   •   169阅

指儿子家暴还强送心理卫生学院 老汉申请个人保护令遭驳回

2026/08/17   •   170阅

冒充移民局和中国官员诈骗案激增 警方:受害者丢逾610万元

2026/08/16   •   729阅

妹妹囤积杂物多年,进出房间都得“爬山”!姐姐申请庭令,两天清走五大卡车

2026/08/15   •   973阅

兀兰工业园食阁厨房起火 民众爬上遮雨棚灭火

2026/08/17   •   325阅

在新加坡乱倒垃圾,被罚8000新元,严重的甚至要坐牢一年!

2026/08/16   •   490阅

新加坡癌症年轻化:二三十岁就确诊,到底怎么了?

2026/08/15   •   325阅

柜台人员说得天花乱坠,配套买下去后却欲哭无泪!新加坡人为何频频踩雷?

2026/08/17   •   171阅

深夜捞金!8名船员在新加坡大士海域偷卖燃油被捕

2026/08/15   •   973阅