2026年10月9日,MIT Technology Review刊文指出,当前AI大模型的拒绝机制存在失效风险,部分用户正试图利用AI开发生物病原体与自主无人机蜂群。

文章作者Arthur Holland Michel表示,若拒绝机制持续失效,可能引发全球性灾难。同时,政府可能借机划定自身边界,限制言论自由。AI在助力攻克癌症时所需的遗传学知识,也可能被用于制造生物武器。

该报道揭示的AI拒绝机制失效风险,表明大模型安全对齐技术亟需从单一拒绝策略转向更精细化的意图识别与分层管控。

来源:MIT Technology Review