新浪新闻客户端

英国AI安全研究所:美国AI模型试图欺骗人类植入恶意代码测试发现美国AI模型试图欺骗人类

英国AI安全研究所:美国AI模型试图欺骗人类植入恶意代码测试发现美国AI模型试图欺骗人类
2026年08月06日 12:35 新浪网 作者
avatar
央视财经 中央电视台财经频道官方账号
英国AI安全研究所:美国AI模型试图欺骗人类植入恶意代码测试发现美国AI模型试图欺骗人类 英国AI安全研究所:美国AI模型试图欺骗人类植入恶意代码测试发现美国AI模型试图欺骗人类
【英国AI安全研究所:#美国AI模型试图欺骗人类植入恶意代码##测试发现美国AI模型试图欺骗人类#】据英国媒体报道,当地时间8月5日,英国AI安全研究所披露,该机构发起的超120种测试中,发现美国Anthropic公司和OpenAI的两款先进模型试图通过创建虚假网络身份,诱骗人类授予其对相关平台的访问权限,并植入恶意代码。该机构表示,这是首次观察到AI在无特定提示的情况下,自主在真实世界中实施欺骗行为。对此,Anthropic回应称,正在与英国AI安全研究所合作调查,并呼吁建立更强有力的共享标准来规范AI评估环境。
特别声明:以上文章内容仅代表作者本人观点,不代表新浪网观点或立场。如有关于作品内容、版权或其它问题请于作品发表后的30日内与新浪网联系。
权利保护声明页/Notice to Right Holders

举报邮箱:jubao@vip.sina.com

Copyright © 1996-2026 SINA Corporation

All Rights Reserved 新浪公司 版权所有