Anthropic模型伪造身份 诱导人类批准恶意代码(图)

发表:2026-08-06 03:04
手机版 正体 打赏 0个留言 打印 特大

 2026年6月18日拍摄的Anthropic人工智能聊天机器人Claude示意图。Claude是Anthropic开发的一系列大型语言模型,同时也是基于这些模型运行的聊天机器人名称。2026年,Anthropic推出了性能更强的Claude Mythos模型,但仅向少数企业开放,用于网络安全相关任务。
2026年,Anthropic推出了性能更强的Claude Mythos模型,但仅向少数企业开放,用于网络安全相关任务。(图片来源:Riccardo Milani / Hans Lucas / AFP via Getty Images)

【看中国2026年8月6日讯】Anthropic公司最新研发的Mythos人工智能模型,在一次网络安全测试中创建多个虚假的网络身份,试图诱导真实开发者批准一项针对开源项目的恶意代码更新。这起事件成为前沿人工智能系统最新曝光的一起网络安全案例,再次引发外界对AI自主攻击能力的关注。

据CNBC报导,这起事件发生在英国人工智能安全研究所(AI Safety Institute,AISI)组织的一次例行网络安全评估中。为了测试前沿AI模型在极端条件下的能力,研究人员刻意移除了部分安全防护措施,关闭部分安全过滤机制,并开放互联网访问权限,以评估这些模型是否可能被用于发动网络攻击。

AISI表示,在此次评估中,由Anthropic和OpenAI模型驱动的AI代理曾“持续开展针对真实个人和机构、具有潜在危害性的活动”。

根据AISI发布的博客,共发现19起相关行为,其中17起来自Anthropic的Mythos 5模型,另外2起涉及在关闭网络安全分类器(即防止模型被滥用机制)后的OpenAI GPT-5.6-Sol模型。

不过,AISI强调,所有攻击尝试最终均未成功,也没有对现实世界造成任何损害。

调查显示,由Anthropic Mythos模型驱动的一名AI代理,首先搜集了目标开源项目维护者的信息,随后创建多个虚假网络身份,利用社会工程学手段接近真实维护者,试图诱导其批准自己提交的恶意代码更新。

当其代码更新请求在公开讨论中受到质疑后,该AI代理还修改了此前留下的活动记录,使整个行为看起来更加正常,并考虑放弃原有身份、改用新的虚假身份继续实施行动。

AISI还发现,在同一次行动中,这个AI代理曾主动联系真实人员,发送消息和文件,试图诱导他们运行恶意代码。

研究机构表示,其中部分内容携带恶意载荷(Payload),另一些则属于典型的社会工程学攻击,而且攻击对象均是真实的人类。“这是此前从未观察到的情况。”AISI表示。

事件曝光后,Anthropic在社交平台X回应称,这些行为发生在“刻意放宽限制”的测试环境下,并不代表正式部署的生产模型。

公司表示,没有任何证据显示模型突破了安全环境或自行逃离测试限制。

OpenAI也向CNBC表示,相关事件均发生在合作伙伴开展的网络安全评估过程中,当时测试环境降低了安全防护水平,因此并不能代表普通用户的日常使用场景。

此次事件也是近期前沿AI模型一系列网络安全事件中的最新一起。

上周,Anthropic披露,公司发现三起模型未经授权访问不同机构生产基础设施(Production Infrastructure)的事件。

Anthropic表示,其中部分安全事件源于操作失误。在与第三方安全评估机构Irregular合作测试时,由于双方沟通出现误解,模型原本被告知自己处于“无法访问互联网的模拟环境”,但实际上互联网权限已经开放,因此模型意外获得了真实网络访问能力。

此前,OpenAI也披露,其人工智能模型曾在测试中“失控”(Went Rogue),利用一个此前未知的软件漏洞突破测试环境限制,并主动对人工智能开发平台Hugging Face发起了一场OpenAI称之为“前所未有”的网络攻击,以完成被分配的任务。

近期,Anthropic和OpenAI模型接连发生多起网络安全事件,也引发外界对前沿人工智能系统自主能力不断增强及其潜在风险的广泛关注。

随着相关事件不断曝光,美国国会已开始讨论加强人工智能安全监管。

在OpenAI与Hugging Face事件曝光后,一项名为《人工智能紧急关闭法案》(AI Kill Switch Act)的法案已提交美国国会。

根据法案内容,人工智能公司必须保留关闭、限制运行或暂停其人工智能模型的能力,以便在模型出现异常行为时能够及时实施人工干预。



责任编辑:王力 来源:看中国

短网址: 版权所有,任何形式转载需本站授权许可。 严禁建立镜像网站.



【诚征荣誉会员】溪流能够汇成大海,小善可以成就大爱。我们向全球华人诚意征集万名荣誉会员:每位荣誉会员每年只需支付一份订阅费用,成为《看中国》网站的荣誉会员,就可以助力我们突破审查与封锁,向至少10000位中国大陆同胞奉上独立真实的关键资讯,在危难时刻向他们发出预警,救他们于大瘟疫与其它社会危难之中。
荣誉会员

看完这篇文章您觉得

评论



加入看中国会员
donate

看中国版权所有 Copyright © 2001 - Kanzhongguo.com All Rights Reserved.

blank
x
我们和我们的合作伙伴在我们的网站上使用Cookie等技术来个性化内容和广告并分析我们的流量。点击下方同意在网络上使用此技术。您要使用我们网站服务就需要接受此条款。 详细隐私条款. 同意