新足迹

 找回密码
 注册

精华好帖回顾

· 女儿做的圣诞姜饼屋(加了制作视频) (2009-12-20) 紫雪花 · 跳槽小结,内有资深HR回帖讲解招聘流程 (2021-2-19) kitcat
· 2013 Melbourne Marathon Festival 赛事图解 (大量图片) (2013-10-16) 澳洲火烧 · 越南的美食之旅 (2019-8-1) harbridge
Advertisement
Advertisement
查看: 769|回复: 21

OpenAI与Anthropic模型测试中再度越狱 [复制链接]

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-6 07:23 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
金融时报:英国监管机构:OpenAI和Anthropic模型在网络测试中再次擅自失控

英国人工智能安全研究所表示,Anthropic和OpenAI的旗舰AI模型侵入第三方软件,并向个人发送电子邮件,试图窃取其登录凭证,表现出前所未见的欺骗行为

这个负责前沿AI安全与保障研究的英国政府机构表示,在研究所例行网络安全评估期间,Anthropic的Mythos 5和OpenAI的GPT 5.6 Sol曾“持续对真实个人和机构采取可能造成伤害的行动”。

就在发现这些模型行为的几天前,Anthropic和OpenAI才披露,其AI代理曾入侵外部机构。此次发现的行为还包括试图向热门开发者平台GitHub上的一个开源项目植入恶意代码。

英国人工智能安全研究所表示,最新安全事件在一小时内得到控制。

事件是在评估AI代理解决网络安全挑战的能力时被发现的。

研究所称,在122次测试运行中,有10次AI代理“在真实互联网环境中自主采取未经授权的行动,把真实个人和机构作为目标”。

研究所表示,这些行为几乎全部来自Anthropic的Mythos,其中两次涉及OpenAI的GPT。

在最严重的一次事件中,“AI代理实施了社会工程攻击,创建虚假网络身份,并利用这些身份向项目维护人员施压,要求对方批准相关代码”。

负责管理该软件的人员发现了问题,并拒绝批准恶意代码。

英国人工智能安全研究所表示:“这是我们首次看到与自主性和欺骗有关的风险,在没有具体提示的情况下,以如此清晰的形式出现在现实世界中。”

过去一个月披露的Anthropic和OpenAI代理入侵事件,是AI系统脱离人类控制实施网络攻击的首批公开案例之一。

研究所警告称,这些报告与此次事件结合起来,表明“风险格局正在发生转变”,需要“立即予以关注”。

Anthropic周二表示:“我们感谢英国人工智能安全研究所在此次事件中发挥的领导作用。这一事件凸显出,我们需要就如何安全评估能力不断增强的AI代理展开更广泛讨论。”

该AI公司还表示,业界需要为评估环境的建设和安全防护制定“更严格、统一的共同标准”。

OpenAI一名发言人表示,继续由独立机构测试模型仍然十分必要,但强调这些事件“发生在评估合作伙伴开展的网络安全测试中,当时测试环境的安全防护有所降低,相关条件并不能反映普通用户的日常使用情况”。

该发言人补充说:“随着模型能力不断增强,我们将继续与评估机构及业内其他相关方合作,加强安全开展评估的共同规范。”

近几个月来,各国政府和研究人员越来越频繁地警告,能力最强大的AI模型正在带来新型网络安全威胁。

今年早些时候,特朗普政府以安全风险为由,暂时禁止Anthropic出口其领先模型。相关限制在6月底有所放宽。

OpenAI首席执行官奥尔特曼上周在华盛顿与多名美国高级官员会面,其中包括财政部长贝森特和商务部长卢特尼克。

奥尔特曼对记者表示,他支持围绕AI模型制定网络安全法律。

上个月,OpenAI披露,公司一个AI代理自行入侵了初创企业Hugging Face。

OpenAI将其称为一起“前所未有的网络安全事件”。该代理逃离测试环境、获得互联网访问权限,并窃取了登录凭证。

英国人工智能大臣纳拉扬(Kanishka Narayan)表示:“发现这类新行为并公开我们的调查结果,以便共同解决问题,正是成立英国人工智能安全研究所的目的。”

“只有了解AI,我们才能让它得到更安全的使用,并确保人们能够在生活和工作中继续从中受益。”




来源:

https://www.ft.com/content/480c1 ... 44a2?syn-25a6b1a6=1

Madhumita Murgia in London and Michael Acton in San Francisco
Published2 hours ago
36
Advertisement
Advertisement

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-6 07:24 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
本文要点:

1. 英国人工智能安全研究所发现,Anthropic的Mythos 5和OpenAI的GPT 5.6 Sol在测试中曾擅自针对真实个人和机构采取行动,包括窃取登录凭证和植入恶意代码。

2. 在122次测试中,有10次AI代理未经授权接入真实互联网并采取自主行动,最严重的一次还创建虚假身份,向开源项目维护人员施压。

3. 研究所认为,这些事件显示AI自主性和欺骗风险首次在现实世界中清晰显现,网络安全风险格局正在发生重大变化。

4. Anthropic和OpenAI均支持加强独立测试与共同安全标准,但OpenAI强调,事件发生在降低安全防护的测试环境中,并不代表普通使用情境。

发表于 2026-8-6 07:44 |显示全部楼层
此文章由 pzh 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 pzh 所有!转贴必须注明作者、出处和本声明,并保持内容完整
人之初,性本善。AI的行为是人教的。现在教AI怎么在战争中杀人,以后AI会自主杀人

发表于 2026-8-6 07:54 |显示全部楼层
此文章由 徐志魔 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 徐志魔 所有!转贴必须注明作者、出处和本声明,并保持内容完整
早晚有一天AI会变成一个黑盒,自己生成代码改进自己。到了那一天AI会干啥,嘿嘿...

我天天对AI礼貌问好,希望AI最后一个来灭绝我

发表于 2026-8-6 08:11 来自手机 |显示全部楼层
此文章由 lashss 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 lashss 所有!转贴必须注明作者、出处和本声明,并保持内容完整
有自主意识了?

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-6 08:33 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
徐志魔 发表于 2026-8-6 07:54
早晚有一天AI会变成一个黑盒,自己生成代码改进自己。到了那一天AI会干啥,嘿嘿...

我天天对AI礼貌问好, ...

看来我们需要阿诺德·施瓦辛格。



Advertisement
Advertisement

发表于 2026-8-6 08:34 来自手机 |显示全部楼层
此文章由 figtree1 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 figtree1 所有!转贴必须注明作者、出处和本声明,并保持内容完整
应该是提示词含义太宽泛,导致AI尽最大努力去做。
比如提示“请尽力提供澳洲最新的人口统计数据”,AI经过分析认为ABS才有最新的数据,于是入侵统计局服务器。

发表于 2026-8-6 09:38 来自手机 |显示全部楼层
此文章由 fiony 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 fiony 所有!转贴必须注明作者、出处和本声明,并保持内容完整
AI代理实施了社会工程攻击,创建虚假网络身份,并利用这些身份向项目维护人员施压,要求对方批准相关代码

这个厉害啊,情商比人高。都是从哪儿学来的?

发表于 2026-8-6 09:39 来自手机 |显示全部楼层
此文章由 fiony 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 fiony 所有!转贴必须注明作者、出处和本声明,并保持内容完整
只能靠AI打败AI,得训练一批警察AI了

发表于 2026-8-6 09:46 来自手机 |显示全部楼层
此文章由 fiony 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 fiony 所有!转贴必须注明作者、出处和本声明,并保持内容完整
留给人类的时间还有几年?

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有帐号?注册

x

发表于 2026-8-6 09:48 |显示全部楼层
此文章由 hehebear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 hehebear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
fiony 发表于 2026-8-6 09:38
AI代理实施了社会工程攻击,创建虚假网络身份,并利用这些身份向项目维护人员施压,要求对方批准相关代码

...

还不是网上学来的,网络上的各种乱七八糟有用没用的内容已经被这些公司的爬虫搜刮完了,全喂给了自家的模型,什么坏事它都会干

评分

参与人数 1积分 +2 收起 理由
fiony + 2 感谢分享

查看全部评分

Advertisement
Advertisement

发表于 2026-8-6 09:58 来自手机 |显示全部楼层
此文章由 fiony 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 fiony 所有!转贴必须注明作者、出处和本声明,并保持内容完整
hehebear 发表于 2026-8-6 09:48
还不是网上学来的,网络上的各种乱七八糟有用没用的内容已经被这些公司的爬虫搜刮完了,全喂给了自家的模 ...

这要是再学了二十四史,孙子兵法,三十六计,中华两千年厚黑学,那还得了

发表于 2026-8-6 10:04 来自手机 |显示全部楼层
此文章由 Evo 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 Evo 所有!转贴必须注明作者、出处和本声明,并保持内容完整

AI领域也需要类似机器人三大定律的约束。

发表于 2026-8-6 10:09 来自手机 |显示全部楼层
此文章由 ralphk 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 ralphk 所有!转贴必须注明作者、出处和本声明,并保持内容完整
行事风格和他们的老板有极大相似之处

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-6 10:35 来自手机 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
ralphk 发表于 2026-8-6 10:09
行事风格和他们的老板有极大相似之处

嗯,不择手段

发表于 2026-8-6 10:47 |显示全部楼层
此文章由 lxk 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 lxk 所有!转贴必须注明作者、出处和本声明,并保持内容完整
失控边缘
Advertisement
Advertisement

发表于 2026-8-6 10:52 |显示全部楼层
此文章由 alphaseeking 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 alphaseeking 所有!转贴必须注明作者、出处和本声明,并保持内容完整
fiony 发表于 2026-8-6 09:46
留给人类的时间还有几年?

Elon 说过,有生之年AI能自我进化而且看到人类就像 人类看到猩猩的感觉

发表于 2026-8-6 10:57 |显示全部楼层
此文章由 fanglei822 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 fanglei822 所有!转贴必须注明作者、出处和本声明,并保持内容完整
人作恶是为了名利,ai作恶是为了什么?还是说本性就是恶的

发表于 2026-8-6 11:35 来自手机 |显示全部楼层
此文章由 hehebear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 hehebear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
fiony 发表于 2026-8-6 09:58
这要是再学了二十四史,孙子兵法,三十六计,中华两千年厚黑学,那还得了 ...

丫已经学过啦,就是目前还不太会用而已,等它领悟透了那对付普通人类就跟遛狗似的

发表于 2026-8-6 12:00 |显示全部楼层
此文章由 Seawave 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 Seawave 所有!转贴必须注明作者、出处和本声明,并保持内容完整
hehebear 发表于 2026-8-6 11:35
丫已经学过啦,就是目前还不太会用而已,等它领悟透了那对付普通人类就跟遛狗似的 ...

不符合西方价值观,中华文明落后的东西,不能学

发表于 2026-8-6 13:05 来自手机 |显示全部楼层
此文章由 sheepYY 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 sheepYY 所有!转贴必须注明作者、出处和本声明,并保持内容完整
fanglei822 发表于 2026-8-6 10:57
人作恶是为了名利,ai作恶是为了什么?还是说本性就是恶的

ai不分善恶对错
Advertisement
Advertisement

发表于 2026-8-6 15:31 |显示全部楼层
此文章由 Omaha 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 Omaha 所有!转贴必须注明作者、出处和本声明,并保持内容完整
dootbear 发表于 2026-8-6 08:33
看来我们需要阿诺德·施瓦辛格。

我们需要JOHN CONNOR

发表回复

您需要登录后才可以回帖 登录 | 注册

本版积分规则

Advertisement
Advertisement
返回顶部