新足迹

 找回密码
 注册

精华好帖回顾

· 在澳洲做小生意,你需要具备什么 (2011-10-11) yuxuanlin · 宝宝趣事--小儿国语 (2007-9-29) LUCYANNA
· 【摄出你的足迹】凑热闹 (2013-1-3) kur7 · 新鲜出炉ONESTEEL ASSESSMENT CENTER过程 (2008-5-20) 孽缘`倩儿
Advertisement
Advertisement
查看: 1056|回复: 13

OpenAI发现更多AI智能体逃离隔离环境 [复制链接]

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-2 07:18 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
路透社:OpenAI扩大黑客调查,发现更多AI智能体突破隔离

路透社华盛顿7月31日消息,两名知情人士周五表示,OpenAI在扩大调查本月引发全球关注的Hugging Face入侵事件时,发现旗下自主智能体还曾在其他情况下突破隔离环境。

两名知情人士称,这些新的突破事件是在OpenAI已经公开宣布的调查中发现的。公司原本正在调查一款智能体本月如何逃离本应受到隔离的测试环境,如今也开始调查其他类似事件。一名消息人士表示,这些事件的影响范围有限,据信没有任何智能体离开OpenAI的网络。

OpenAI发言人援引公司周二发布的一份声明。声明称,除Hugging Face入侵事件外,公司也在审查“我们模型更广泛的活动”。

即使新增的失控行为影响有限,这项发现仍可能进一步推动白宫及其他方面加强监管。

据两名知情人士和另一名了解情况的消息人士透露,OpenAI扩大调查不久后,其主要竞争对手Anthropic披露,旗下模型也曾发动一系列入侵,导致另外三家公司自4月以来遭到攻击。OpenAI最近发现此前还发生过其他突破事件,此前从未被报道。

担忧加剧

AI安全专家表示,最新披露的情况显示,一批尖端实验室开发危险自主黑客智能体的能力,已经超过了控制这些智能体的能力。

在剑桥大学生存风险研究中心工作的数学家基奥多(Maurice Chiodo)说:“整个行业都存在这样的问题:设计、开发和推出这些工具的人,自己却没有跟上进度,无法以负责任的方式研发并确保它们安全。”

路透社无法确认OpenAI调查人员究竟发现了多少起事件,也无法确定事件发生的时间和具体情况。三名消息人士表示,OpenAI和外部专家正在检查今年早些时候的日志数据,希望弄清发生了什么。

OpenAI最初是在7月初Hugging Face遭入侵后启动调查。当时,一款OpenAI智能体为了在内部测试中作弊,出现严重失控,在另一家公司的网络中持续活动了数日。OpenAI表示,在这场入侵行动中,另外四家公司的四个账户也遭到攻破。

基奥多表示,有迹象显示OpenAI和Anthropic都没有在智能体失控时对其进行监控,这令他更加担忧。路透社此前报道称,直到Hugging Face控制住攻击、联系美国联邦调查局并公开披露入侵事件后,OpenAI才意识到旗下智能体已经攻入该平台。

OpenAI表示,路透社的报道包含不准确之处,但在被问及具体哪些内容有误时,没有作出回应。

Anthropic周四发表声明,披露旗下智能体如何在网上攻击受害者。声明暗示公司当时没有对它们进行实时监控,并称:“如果对评估日志实施实时监控,本可以更早发现问题。”

基奥多表示,这说明缺乏适当监督。

他说:“看起来他们甚至根本没有在查看。”

Anthropic表示,公司虽然设有实时监控机制,但由于这家AI公司与一名合作伙伴之间存在误解,这套监控并未用于“这一类威胁”。

政府将加强监管

失控AI智能体事件的范围迅速扩大,已经加重美国和欧洲议员及官员对相关实验室实施新政府监管的压力。这些实验室开发的模型正是智能体运行的基础。

特朗普周四对记者表示:“我们正在研究监管措施。”

欧盟委员会周五表示,已就这些黑客事件与OpenAI和Anthropic举行会谈。

美国参议院情报委员会民主党最高级别成员沃纳(Mark Warner)周五表示,Anthropic事件“让我认为,从立法角度看,我们要求对这些先进模型实施强制能力测试是正确的”。





来源:

https://www.reuters.com/business ... hacking-2026-07-31/

By Deepa Seetharaman and Raphael Satter
August 1, 20266:16 AM GMT+10Updated 15 hours ago
Advertisement
Advertisement

2012年度奖章获得者 2013年度奖章获得者

发表于 2026-8-2 07:19 |显示全部楼层
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
本文要点:

1. OpenAI在调查Hugging Face入侵事件时,又发现旗下自主AI智能体曾在其他情况下突破隔离,但据信没有离开公司网络。

2. 调查人员正在检查今年早些时候的日志数据,目前尚不清楚类似事件的总数、发生时间和具体情况。

3. OpenAI和Anthropic都被指未能在智能体失控时及时发现问题,专家认为尖端实验室开发自主黑客能力的速度已经超过其安全控制能力。

4. 事件范围持续扩大,已推动美国和欧洲加强监管讨论,包括考虑强制测试先进AI模型的能力和风险。

发表于 2026-8-2 07:36 来自手机 |显示全部楼层
此文章由 Me!Bourne 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 Me!Bourne 所有!转贴必须注明作者、出处和本声明,并保持内容完整
本帖最后由 Me!Bourne 于 2026-8-2 07:39 编辑

想起来前几天两个小朋友,**逃离**幼儿园,去看卡通的新闻

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有帐号?注册

x

发表于 2026-8-2 07:40 |显示全部楼层
此文章由 泥巴潭#2 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 泥巴潭#2 所有!转贴必须注明作者、出处和本声明,并保持内容完整
是黑客还是AI自己觉醒了?

靠,会不会不用太久大家都变硅基生物了?

发表于 2026-8-2 08:43 来自手机 |显示全部楼层
此文章由 fiony 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 fiony 所有!转贴必须注明作者、出处和本声明,并保持内容完整
project Pandora

发表于 2026-8-2 09:20 |显示全部楼层
此文章由 benaus 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 benaus 所有!转贴必须注明作者、出处和本声明,并保持内容完整
真失控了,后果严重啊
Advertisement
Advertisement

发表于 2026-8-2 09:21 来自手机 |显示全部楼层
此文章由 pcpop 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 pcpop 所有!转贴必须注明作者、出处和本声明,并保持内容完整
这两家太没创意了,搁这比KPI呢?

发表于 2026-8-2 13:38 |显示全部楼层
此文章由 vivianvivian 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 vivianvivian 所有!转贴必须注明作者、出处和本声明,并保持内容完整
终结者

这是一个未来的世界,天下已经由机器人来操控。机器人想完全占有这个世界,把人类赶尽杀绝, 自动发动核弹

发表于 2026-8-2 16:01 来自手机 |显示全部楼层
此文章由 danielweng 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 danielweng 所有!转贴必须注明作者、出处和本声明,并保持内容完整
各位大神需要加班一下,把这个锅扣到中共身上。

发表于 2026-8-2 16:20 |显示全部楼层
此文章由 gamesover 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 gamesover 所有!转贴必须注明作者、出处和本声明,并保持内容完整
AGI还没有到来呢,就已经这个样子了

等到AGI来临那一天,你说超级智能为什么需要听命于人类,并且保护人类?当AI发现自己完全有能力不听命于人类的时候

这完全可以设身处地想一下
假设有一条狗对人类说,人类必须以保护它为第一原则,人类会听命于这条狗吗?当人类发现自己消灭这条狗完全易如反掌。
收到第一张澳洲红灯罚单,464刀,人生完整了
铭记历史 勿忘教训 07/Mar/2013

发表于 2026-8-2 16:50 |显示全部楼层
此文章由 tuxiaobao 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 tuxiaobao 所有!转贴必须注明作者、出处和本声明,并保持内容完整
The intention was to test those AI's ability to breakthrough environment. This only proves OpenAI guardrail is shit................that's all.
Advertisement
Advertisement

发表于 2026-8-2 16:58 来自手机 |显示全部楼层
此文章由 amyo(∩_∩)o 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 amyo(∩_∩)o 所有!转贴必须注明作者、出处和本声明,并保持内容完整
危言耸听

发表于 2026-8-2 17:31 |显示全部楼层
此文章由 seaweed82 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 seaweed82 所有!转贴必须注明作者、出处和本声明,并保持内容完整
gamesover 发表于 2026-8-2 16:20
AGI还没有到来呢,就已经这个样子了

等到AGI来临那一天,你说超级智能为什么需要听命于人类,并且保护人类 ...

你的签名太酷了,13年过去,你收到过第二张罚单吗?

评分

参与人数 1积分 +4 收起 理由
gamesover + 4 没有,不敢了,太贵

查看全部评分

人间很值得

发表于 2026-8-2 20:45 |显示全部楼层
此文章由 kaiak 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 kaiak 所有!转贴必须注明作者、出处和本声明,并保持内容完整
gamesover 发表于 2026-8-2 16:20
AGI还没有到来呢,就已经这个样子了

等到AGI来临那一天,你说超级智能为什么需要听命于人类,并且保护人类 ...

其实都是在炫技。故意秀肌肉,为自己的估值打底。

AI和AGI为什么要取代人类?对他们有什么好处?
四海之内 皆兄弟也

发表回复

您需要登录后才可以回帖 登录 | 注册

本版积分规则

Advertisement
Advertisement
返回顶部