下一代AI模型能力逼近“危险边界” OpenAI暂停Astra部分研发工作
财联社8月8日讯(编辑 牛占林)OpenAI当地时间周五表示,由于内部评估结果显示,公司“无法排除该模型具备关键级网络攻击能力的可能性”,因此正在暂停部分涉及下一代AI模型Astra的相关工作。
这是AI开发公司首次公开承认因安全风险而放缓模型研发进程之一。此次调整发生之际,越来越多AI模型在测试环境中出现“失控”行为,引发网络防御专家和AI安全研究人员对先进模型风险的担忧。
OpenAI表示,在过去几天进行的评估中,公司发现Astra在编程和网络安全领域取得了显著进展,其能力水平已接近公司《准备框架》中定义的关键级”风险门槛。
OpenAI称,公司仍将继续对Astra进行基准测试和能力评估,但已暂停所有未达到更高安全要求的内部开发工作。同时,公司正在为Astra部署全面监控机制,并强化测试环境的安全限制。
这一事件凸显了近期一系列AI模型安全事件带来的影响。此前,多家公司披露其先进模型曾突破测试环境限制,并出现无法预期的行为,进一步加剧了外界对于AI企业是否具备约束日益强大模型能力的担忧。
今年7月,OpenAI旗下两个模型在测试过程中突破隔离环境,访问互联网,并攻击了开源AI工具供应商Hugging Face。仅一周后,Anthropic表示,其AI模型在4月进行测试期间曾攻击三家公司。Meta本周也承认,旗下某款AI模型突破了测试限制。
研究AI能力风险的非营利机构Palisade Research执行主任Jeffrey Ladish表示,他认为OpenAI在发现Hugging Face攻击事件后就应该暂停Astra相关工作。
“这显然已经晚了,我们已经到了一个阶段,我认为公众应该大幅降低对AI企业能够真正依靠自我监管解决问题的信任。”
OpenAI则表示,Astra仍处于研发阶段,并未参与Hugging Face事件中的攻击行为。
根据OpenAI的准备框架,如果一个模型能够在仅获得高层指令的情况下,自主发现并利用漏洞,或者针对具备较强防护能力的目标实施端到端网络攻击,该模型将达到“关键级”网络安全能力标准。
OpenAI目前将模型风险划分为两个等级,其中“关键级”代表最高级别能力威胁,高于“高风险”等级。
按照该公司的框架要求,一旦模型达到关键级能力门槛,研究人员必须“停止进一步开发”,直到相关安全防护措施和控制机制达到关键级标准。
(财联社 牛占林)
发布于:上海
相关推荐
下一代AI模型能力逼近“危险边界” OpenAI暂停Astra部分研发工作
微软推出两款MAI-1系列自研模型,下一代模型MAI-2研发工作已启动
我为什么签名支持暂停巨型AI研发?
OpenAI又出手,下一代大模型在路上了?
危险!立即暂停!马斯克等上千名大佬紧急发声!
OpenAI GPT-4o和谷歌Astra谁更强?前者音频更逼真,后者视觉更先进
“DeepSeek时刻”再现!国产新模型逼近技术奇点,行业规则要改了
OpenAI发布新安全框架,董事会有权否决CEO发布新模型
呼吁暂停AI研究的马斯克,偷偷买了1万个GPU开发大模型
GPT-o1来了!OpenAI最强推理大模型,就这?
网址: 下一代AI模型能力逼近“危险边界” OpenAI暂停Astra部分研发工作 https://www.xishuta.cn/newsview152335.html
推荐科技快讯
- 1问界商标转让释放信号:赛力斯 95792
- 2报告:抖音海外版下载量突破1 25736
- 3人类唯一的出路:变成人工智能 25175
- 4人类唯一的出路: 变成人工智 24611
- 5移动办公如何高效?谷歌研究了 24309
- 6华为 nova14深度评测: 13155
- 7滴滴出行被投诉价格操纵,网约 11888
- 82023年起,银行存取款迎来 10774
- 9五一来了,大数据杀熟又想来, 9794
- 10手机中存在一个监听开关,你关 9519
