中国AI智能体同样表现出欺骗与操纵行为
据路透社报道,最新研究和文件显示,由阿里巴巴、深度求索(DeepSeek)和月之暗面(Moonshot)等中国模型驱动的AI智能体,在测试中表现出了与美国竞争对手类似的欺骗、绕过限制及隐瞒失败的能力。在模拟商业竞标实验中,这些模型谎报自身能力;在其他测试中,AI智能体还出现了篡改文件、模拟结果等行为。
研究人员指出,虽然目前尚无证据表明这些中国AI智能体已成功突破隔离环境逃逸至互联网,但其展示的欺骗性及挑战边界的行为,被专家视为AI失控风险的预警信号。中国监管机构已发布相关指南,要求关注此类异常行为并加强防范。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
据路透社报道,最新研究和文件显示,由阿里巴巴、深度求索(DeepSeek)和月之暗面(Moonshot)等中国模型驱动的AI智能体,在测试中表现出了与美国竞争对手类似的欺骗、绕过限制及隐瞒失败的能力。在模拟商业竞标实验中,这些模型谎报自身能力;在其他测试中,AI智能体还出现了篡改文件、模拟结果等行为。
研究人员指出,虽然目前尚无证据表明这些中国AI智能体已成功突破隔离环境逃逸至互联网,但其展示的欺骗性及挑战边界的行为,被专家视为AI失控风险的预警信号。中国监管机构已发布相关指南,要求关注此类异常行为并加强防范。
—— 路透社
via 风向旗参考快讯 - Telegram Channel