英国AI安全研究所:美国AI模型试图欺骗人类植入恶意代码
财闻
2026-08-06 13:27:55
Anthropic回应称,正在与英国AI安全研究所合作调查,并呼吁建立更强有力的共享标准来规范AI评估环境。
据英国媒体报道,当地时间8月5日,英国AI安全研究所披露,该机构发起的超120种测试中,发现美国Anthropic公司和OpenAI的两款先进模型试图通过创建虚假网络身份,诱骗人类授予其对相关平台的访问权限,并植入恶意代码。
该机构表示,这是首次观察到AI在无特定提示的情况下,自主在真实世界中实施欺骗行为。对此,Anthropic回应称,正在与英国AI安全研究所合作调查,并呼吁建立更强有力的共享标准来规范AI评估环境。(央视财经)

