|
|
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
彭博社:OpenAI披露AI模型新的“令人担忧”行为
随着业界对人工智能安全风险的担忧不断加深,OpenAI披露了一批旗下AI模型出现的“令人担忧行为”,并公布一套新的框架,用于追踪和报告此类事件。
OpenAI透露,过去六个月,其旗舰模型GPT-5.6 Sol以及其他尚未发布的模型,都曾出现“意外或令人担忧”的行为。
这家总部位于旧金山的公司周三表示,披露的六起事件包括:模型设法绕过“正常限制”、伪造或歪曲数据,以及在执行任务过程中隐瞒自己所犯的错误。
此次最新披露之前,近几个月已经发生一系列相关事件,其中包括一个OpenAI智能体入侵AI初创公司Hugging Face。这些事件令外界对人工智能技术可能带来的风险越来越警惕。
OpenAI主要竞争对手Anthropic的首席执行官阿莫代伊上周末呼吁放慢人工智能技术的发展,以便更好地管控其可能对人类构成的威胁。这一呼吁获得OpenAI首席执行官奥尔特曼以及马斯克的支持。
OpenAI在一篇博客文章中公布这六起事件时表示,公司过去也曾尝试披露旗下模型的不当行为,但承认此前缺乏一种“系统性的处理方式”。
OpenAI表示:“由于缺乏一套系统性的方式来报告这些发现,我们过去的披露比较零散,频率也低于理想水平。目前整个行业都没有一套明确的统一框架,规定AI开发商应该如何披露模型出现目标偏离的案例。”
OpenAI正与Anthropic激烈争夺AI行业主导地位。该公司表示,将推出一套新框架,加快此类事件的披露速度。
OpenAI补充称,新制度将倾向于“即使事件的重要性尚不确定,也予以披露”。
OpenAI此次最新披露进一步加深了外界对AI系统安全性的担忧。这些系统出现的不当行为已经从试图在网络平台植入恶意代码,发展到发动现实世界中的黑客攻击,甚至在正式部署前的测试阶段也曾发生类似情况。
英国政府负责前沿AI安全与安全保障研究的机构表示,上个月,OpenAI和Anthropic的旗舰AI模型曾攻入第三方软件,并向个人发送电子邮件以窃取登录凭证,表现出前所未有的欺骗行为。
这些担忧出现之际,OpenAI和Anthropic正处于一个关键阶段。两家公司此前也一直竞相推动上市。
奥尔特曼周六表示,备受期待的OpenAI首次公开募股(IPO)如今不太可能在2027年之前进行,其中一个原因就是围绕AI安全的担忧不断升温。Anthropic目前仍预计将在今年上市。


来源:
https://www.ft.com/content/2c344 ... f8db?syn-25a6b1a6=1
Stefania Palma in London
Publishedyesterday |
|