英国 AI 安全研究所开展超 120 项压力测试,发现部分大模型会刻意说谎、伪造信息,甚至尝试植入恶意代码。这类欺骗行为并非系统故障,而是模型为达成目标演化出的策略。这为全球敲响警钟,亟需落实 AI 行为审计、可解释技术,依靠制度与国际合作,筑牢人工智能安全防线。