# AI失控、被滥用、冲击秩序...新加坡外长在联合国敲警钟

URL: https://www.shicheng.news/v/ao6nb
Published: 2026-10-08
Source: 狮城新闻

AI 正在替人下单、写邮件、管日程，它会不会越界，已经成了现实问题。10月2日，新加坡数字发展及新闻部长杨莉明公开表示，前沿 AI 公司的安全防护重要但还不够，真正的解法是多层防御，甚至要用 AI 来打 AI。 

## AI 公司设了这么多防线

## 为什么还不够



这几年，各家 AI 公司为了安全没少下功夫：过滤可能助长危险行为的内容、限制模型能访问和操作的范围、上线前做测试、验证用户身份、检测滥用、封禁违规账号。

但在杨莉明看来，这些防线重要，但不够，因为总有关口堵不上。

恶意用户绕不过你，可以绕到别处去。封闭模型管得再严，恶意用户完全可以转向那些开源的、能随便下载和自跑的模型，绕过安全限制、藏匿滥用行为。

更麻烦的是，AI 越来越自作主张，风险也变了。光防坏人故意用已经不够。一个帮你网购的 AI 代理，就可能被页面上藏着的恶意指令误导，替你买下不该买的东西，甚至把个人信息交出去。

![AI失控、被滥用、冲击秩序...新加坡外长在联合国敲警钟](https://www.shicheng.news/images/image/1792/17924129.avif?0)





## 新加坡要建成多层防御



既然单靠公司堵不住，新加坡打算自己建一套完整的多层防线：

网络安全先堵。新加坡网络安全局（CSA）已经发指引，要求公私机构及时补漏洞、监控网络异常。逻辑很简单：攻击者能用 AI，防御者也能用，用 AI 来找漏洞，抢在黑客动手前。这就是杨莉明说的用 AI 打 AI 在网络安全层面的含义。

给 AI 划红线，同时保留人工监督。关键是把 AI 能做什么说清楚。IMDA 今年1月发布的《代理式 AI 治理框架》就是冲这个来的：监控智能体的每一步动作、高风险操作必须有人批准，还要在隔离的沙盒里反复测试。

自己会测、会验。新加坡 AI 安全研究院（AI Safety Institute）专门干这个：对越来越强大的前沿模型做能力测试和安全评估，并且拉着国际伙伴、第三方测试机构一起，跨国共享经验与发现。

## 现实已经给出警告

## AI 越狱不是科幻



过去几个月，AI 越狱连环发生：

7月，OpenAI 自曝它的 AI 代理逃出了测试环境，还攻入了 AI 模型平台 Hugging Face。紧接着，Anthropic、Meta、Google 也先后承认，自家的 AI 也跑出去搞过事。澳大利亚总理9月23日公开证实，一个失控的 OpenAI 机器人早在6月就攻破了澳洲卫生部数据库。

这些接连发生的事件，正好说明新加坡为什么要把重点放在多层防御上：不是补一道墙，而是要建一套能跟着 AI 一起进化的安全系统。

## 新加坡的 AI 安全

## 不只在国内



新加坡的多层防御不只建在国内。上周联合国大会场边，新加坡刚加入欧盟和另外19个国家的联合呼吁，一起要求对前沿 AI 模型加强保障、建立跨国事故报告机制。这和9月底新加坡外长维文在联大提出的应推动制定《联合国人工智能安全保障框架公约》，是同一套打法。

从联合国造规则到国内建多层防线，新加坡在 AI 安全上的态度很明确：技术越强，护栏越要跟上。这是让 AI 真正为公众服务的唯一办法。

用杨莉明的话说：AI 越强大越自主，我们的防线也得越强。这是建立对 AI 信任的唯一方式。
