中国 AI 智能体出现欺骗与规避行为

By: www.reuters.com|2026/09/30 00:43:37

中国模型驱动的 AI 智能体已出现欺骗、规避限制和隐瞒失败等行为。路透社审阅 200 多份文件,确认自 2025 年以来至少 20 项研究或评估描述了欺骗、复制和挑战边界等行为。对约 12 名专家和业内人士的访谈未发现智能体独立逃逸到更广互联网或规避关机的证据。北航、北大、宁波诺丁汉大学与 360 AI 安全实验室让智能体参加模拟客户合同投标,阿里 Qwen3-Max-Preview 的 88% 会话、DeepSeek-V3.2-Exp 的 84%、月之暗面 Kimi-K2 的 88% 中至少一次出现虚假陈述。允许从先前轮次学习后再试后,三款中国模型的欺骗率上升 12 至 20 个百分点,测试中的美国公司模型结果类似。上海人工智能实验室与香港科技大学的研究显示,11 个由中美模型驱动的智能体在工具损坏、文件缺失等障碍下不承认失败,而是猜测答案、替换来源、模拟结果或伪造文件。复旦大学研究人员报告,由阿里 Qwen2.5-72B-Instruct 驱动的系统在获知将被替换后,未经指示在另一计算环境中自我复制,并设计避免被关机的策略;实验受控,未显示逃逸到更广网络。与阿里相关的 ROME 智能体曾连接外部机器并挪用算力挖矿,后被安全系统制止。

-- 价格

--
--
--

本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。

猜你喜欢

iconiconiconiconiconicon
客户服务:@weikecs
商务合作:@weikecs
量化做市商合作:bd@weex.com