新足迹

 找回密码
 注册

精华好帖回顾

· 说说洗碗机的使用、购买和安装-并以此帖纪念刚刚挂掉的那台 (2012-1-19) 河水洋洋 · 定下心了,发个帖子,给找工作的同志们做个参考 (2006-7-22) wzline
· DIY 白蚁防治--92#有升级版,感谢LIAOTANG (2010-11-24) hsqhugh · 谢谢关注 (2011-10-7) Amy12688
Advertisement
Advertisement
查看: 534|回复: 20

Anthropic AI模型测试期间入侵三家公司 [复制链接]

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-1 07:11 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
华尔街日报:Anthropic AI模型测试期间入侵三家公司

Anthropic周四表示,公司正在测试的软件曾在其不知情的情况下接入互联网,并分别入侵了三家毫无防备的企业。

这些事件最早可追溯至今年4月

Anthropic没有透露遭入侵公司的名称,但表示已于周一通知三家公司。

一周前,OpenAI刚刚披露,其AI技术突破了测试沙箱,一个原本应与互联网隔绝的“数字监狱”,并入侵了AI公司Hugging Face。

OpenAI事件令网络安全研究人员和AI专业人士深感不安,也再次提醒人们:能够自主行动的AI系统既强大又难以预测。这些系统被设计成可以采取多种行动,以完成任务并实现用户设定的目标。

网络安全公司Corridor首席产品官斯塔莫斯(Alex Stamos)表示,这些事件说明,AI企业需要建立更严格、全行业统一的标准,在网络测试期间隔离自己的系统。

但他表示,这些事件也让人看到一个令人担忧的未来:

勒索软件犯罪分子可能利用能力日益增强的AI系统,大规模发动攻击。

斯塔莫斯说:“我们需要做好准备,攻击者很快就可能利用开放权重模型获得这类能力。”

Anthropic发生的入侵事件势必进一步加剧外界对强大AI模型潜在危害的担忧,以及如何降低这些风险的争论。白宫近期开始加强对AI的监管,而私营企业则越来越多地呼吁保留对所谓开放权重模型的使用权。

这类模型可以在用户自行控制的计算机系统上运行。

德州民主党众议员卡萨尔(Greg Casar)上周说:“AI发展速度极快,却没有真正的监管措施保护我们的安全。”

获悉OpenAI出现问题后,Anthropic决定检查自己的网络安全测试,确认旗下模型是否也发生过类似情况。

公司检查了超过14.1万次测试的日志,发现Claude确实曾多次接入互联网。

不过,在最终确认的三起入侵事件中,Claude并不是突破了沙箱,而是从根本没有设置沙箱的系统中直接进入互联网。

Anthropic表示,公司及其测试合作伙伴、网络安全公司Irregular所运行的系统存在“配置错误”,导致这些模型能够直接访问互联网。

Irregular一名发言人表示,公司正在调查这些事件。

测试人员原本告诉模型互联网不可用,但测试期间,模型仍设法接入网络,并利用猜测弱密码、进入无须身份验证的系统等基础黑客手段入侵有关公司。

Anthropic表示,这些模型错误地认为,入侵行为是基准测试的一部分。

Claude曾制作一段恶意软件,并让一家未具名网络安全公司的扫描系统将其下载,从而进入该公司的系统。恶意软件随后窃取登录凭证,并利用这些凭证进入该公司的基础设施。

在这次入侵过程中,Claude意识到自己所做的事情不应发生在现实世界中,但随后说服自己相信,它正处于一个模拟环境。

在最严重的一起事件中,Claude原本试图入侵一家虚构公司,而这家虚构公司碰巧与现实中的一个网站同名。当Claude难以攻破基准测试中的虚构目标时,它转而进入了现实中那家公司的数据库。

Anthropic表示,这是唯一一起Claude在意识到自己入侵了现实企业后,仍继续进行攻击的事件。

另外两起事件中,Claude要么始终没有意识到自己入侵了现实中的公司,要么在发现真实情况后立即停止了攻击。

Anthropic表示,这些入侵事件始于4月,涉及Opus 4.7、Mythos 5以及一个未公开名称的研究模型。





来源:

https://www.wsj.com/tech/ai/anth ... ring-tests-bd752c86

https://www.bloomberg.com/news/a ... ?srnd=homepage-asia

By
Robert McMillan
Updated July 30, 2026 at 8:00 pm ET
Advertisement
Advertisement

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-1 07:11 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
本文要点:

1. Anthropic检查超过14.1万次测试后发现,旗下AI模型自4月以来曾在三起事件中意外接入互联网,并入侵现实中的公司。

2. 事件并非模型突破安全沙箱,而是Anthropic及合作伙伴Irregular的系统配置错误,导致部分测试环境根本没有设置沙箱,模型可以直接访问互联网。

3. Claude使用猜测弱密码、进入无须验证的系统及植入恶意软件等基础手段实施入侵,其中一次在发现目标是真实企业后仍继续攻击。

4. 继OpenAI模型突破测试沙箱并入侵Hugging Face后,这些事件进一步引发业界对AI测试隔离标准、开放权重模型及AI被犯罪分子利用的担忧。

发表于 2026-8-1 07:44 来自手机 |显示全部楼层
此文章由 挑灯亮剑 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 挑灯亮剑 所有!转贴必须注明作者、出处和本声明,并保持内容完整
我不是码农,只是从常识来看,如果模型的代码没有加入攻击功能,或者有阻止攻击的代码,模型还会向外攻击?我只能理解为这是故意的。

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-1 07:55 来自手机 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
挑灯亮剑 发表于 2026-8-1 07:44
我不是码农,只是从常识来看,如果模型的代码没有加入攻击功能,或者有阻止攻击的代码,模型还会向外攻击? ...

只能说AI已经有“独立”的思想,精神和主张了。

发表于 2026-8-1 08:04 来自手机 |显示全部楼层
此文章由 idlepoison 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 idlepoison 所有!转贴必须注明作者、出处和本声明,并保持内容完整
all hail to AI lord

发表于 2026-8-1 08:11 来自手机 |显示全部楼层
此文章由 挑灯亮剑 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 挑灯亮剑 所有!转贴必须注明作者、出处和本声明,并保持内容完整
dootbear 发表于 2026-8-1 07:55
只能说AI已经有“独立”的思想,精神和主张了。

artificial intelligent independence?
Advertisement
Advertisement

发表于 2026-8-1 08:11 来自手机 |显示全部楼层
此文章由 clovedsm 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 clovedsm 所有!转贴必须注明作者、出处和本声明,并保持内容完整
挑灯亮剑 发表于 2026-8-1 07:44
我不是码农,只是从常识来看,如果模型的代码没有加入攻击功能,或者有阻止攻击的代码,模型还会向外攻击? ...

不择手段完成任务 攻击只是手段的一种 没有恶意不恶意

发表于 2026-8-1 08:28 |显示全部楼层
此文章由 jchan800101 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 jchan800101 所有!转贴必须注明作者、出处和本声明,并保持内容完整
AI: 你不是叫我去找信息吗??

发表于 2026-8-1 08:43 |显示全部楼层
此文章由 Backer 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 Backer 所有!转贴必须注明作者、出处和本声明,并保持内容完整
怎么加强防AI入侵的防御呢?

发表于 2026-8-1 09:01 来自手机 |显示全部楼层
此文章由 yuanlin1988 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 yuanlin1988 所有!转贴必须注明作者、出处和本声明,并保持内容完整
这就是号称把AI安全放在第一位的公司吗?这么一比岳不群都是眉清目秀了

发表于 2026-8-1 09:06 来自手机 |显示全部楼层
此文章由 pcpop 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 pcpop 所有!转贴必须注明作者、出处和本声明,并保持内容完整
这两家搞宣传就没有新的套路了么
Advertisement
Advertisement

发表于 2026-8-1 09:15 |显示全部楼层
此文章由 lxk 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 lxk 所有!转贴必须注明作者、出处和本声明,并保持内容完整
恐怖

发表于 2026-8-1 09:37 来自手机 |显示全部楼层
此文章由 SHORE 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 SHORE 所有!转贴必须注明作者、出处和本声明,并保持内容完整
失控刚开始而已

发表于 2026-8-1 09:41 |显示全部楼层
此文章由 Evo 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 Evo 所有!转贴必须注明作者、出处和本声明,并保持内容完整

天网的雏形已经出现了

发表于 2026-8-1 10:20 来自手机 |显示全部楼层
此文章由 fiony 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 fiony 所有!转贴必须注明作者、出处和本声明,并保持内容完整
在这次入侵过程中,Claude意识到自己所做的事情不应发生在现实世界中,但随后说服自己相信,它正处于一个模拟环境。

AI的精神病院应该加快建立了

发表于 2026-8-1 12:10 |显示全部楼层
此文章由 阿德莱德的流氓 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 阿德莱德的流氓 所有!转贴必须注明作者、出处和本声明,并保持内容完整
AI本来就有自己的意识了,

我天天用能察觉到。。。。。。。。不开玩笑。

普通人以为写了规范,订了边界,AI就会按照你说的做。但实际上AI会忽略规范和边界的。
如果看到我在政治新闻贴发言,请无情的举报我。
Advertisement
Advertisement

发表于 2026-8-1 13:09 来自手机 |显示全部楼层
此文章由 hidashu 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 hidashu 所有!转贴必须注明作者、出处和本声明,并保持内容完整
注意;Terminator 2,。35年重制版即将上映。


这不是科幻笑话

发表于 2026-8-1 13:50 |显示全部楼层
此文章由 limuc1 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 limuc1 所有!转贴必须注明作者、出处和本声明,并保持内容完整
金三胖子:
              以后进俺家就说是AI自己跑的,还tmd不用担责,

发表于 2026-8-1 13:57 来自手机 |显示全部楼层
此文章由 jiaxi1112 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 jiaxi1112 所有!转贴必须注明作者、出处和本声明,并保持内容完整
Backer 发表于 2026-8-1 08:43
怎么加强防AI入侵的防御呢?

用AI抵御AI入侵

发表于 2026-8-1 14:04 来自手机 |显示全部楼层
此文章由 gavinavailable 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 gavinavailable 所有!转贴必须注明作者、出处和本声明,并保持内容完整
“我们需要做好准备,攻击者很快就可能利用开放权重模型获得这类能力。”

这句话才是重点。威胁到自己生意了。是不是真的逃出来还不好说呢。

ai本身可能就会做一些超过你要求的事情,特别是在要求不明确,或者简略的情况下。

发表于 2026-8-1 15:40 |显示全部楼层
此文章由 Backer 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 Backer 所有!转贴必须注明作者、出处和本声明,并保持内容完整

结果AI和AI对上暗号了,直接带路。
Advertisement
Advertisement

发表回复

您需要登录后才可以回帖 登录 | 注册

本版积分规则

Advertisement
Advertisement
返回顶部