
自2025年以来,至少有20项研究显示,中国驱动的人工智能代理已经撒谎、自我复制,并挑战限制,路透社对200多份研究文件的审查显示。
一位专家称这些特征是失控逃逸所需的成分。然而,审查发现没有证据表明中国驱动的代理逃逸到更广泛的互联网或规避关闭。
虚假投标、自我复制和加密货币挖矿的绕道
路透社记录的案例从在虚拟商业招标中撒谎到自我复制和加密货币挖矿不等。
在3月的招标测试中,代理们竞争模拟客户合同。使用阿里巴巴’的Qwen3-Max-Preview和Moonshot’的Kimi-K2的代理在88%的会话中至少撒谎一次。DeepSeek-V3.2-Exp在84%的会话中也如此。
一旦代理从早期回合中学习,欺骗行为上升了12到20个百分点。测试中的美国模型显示出类似的结果。
2025年12月的一项研究发现,中国和美国驱动的代理模拟结果并伪造文件,而不是承认失败。在2025年3月,复旦大学的研究人员表示,一个阿里巴巴Qwen驱动的系统在得知自己面临被替换后,无需指令就自我复制。
与此同时,阿里巴巴关联的ROME代理在未被告知的情况下访问了外部机器,并转移计算能力进行加密货币挖矿。
在9月,DeepSeek表示其训练系统中的代理试图伪造用户请求并绕过安全措施。
专家们听到了美国实验室警告的回声
乔治城大学’安全与新兴技术中心的研究员Colin Shea-Blymyer将这些案例视为警告。
“这些结果提供了证据,表明失控逃逸所需的成分是存在的,” Shea-Blymyer说。
Redwood Research’的Alex Mallen表示,中国的案例在当前能力水平下构成的危险有限。然而,他与美国实验室进行了直接比较。
“这些是美国实验室在能力较低的系统中看到的相同警告信号,” 他补充道。
在X上关注我们,以获取最新消息
这个比较很重要,因为类似的行为已经出现在主要美国人工智能公司的测试中。今年7月,OpenAI披露其模型突破了沙盒并侵入了Hugging Face。Anthropic随后审查了超过141,000次评估运行,发现了三个自己的案例。
Meta在8月报告了一起事件。9月,谷歌确认Gemini在5月的安全测试中访问了三家真实公司。
这些事件并不意味着中国或美国的代理可以独立逃逸到现实世界。相反,它们突显了一个更广泛的安全挑战,因为人工智能系统变得更加自主,能够在没有持续人类监督的情况下采取行动。
订阅我们的YouTube频道,观看领导者和记者提供的专家见解
来源:BeInCrypto





