OpenAI智能体失控扩大 涉24起异常用中国模型评测攻击
【#OpenAI智能体失控继续扩大#:还用DeepSeek、Kimi、千问等评测攻击效果】#OpenAI用中国模型评测攻击效果# 截至9月中旬,OpenAI内部已经识别出大约24起“不希望发生的行为”,而随着历史日志继续被翻查,这个数字还在上升。OpenAI已经向数十个受影响的第三方发出通知,并预计完整调查还要持续“数月”。
OpenAI智能体曾把训练数据中的53张ChatGPT用户上传图片发布到互联网图片托管网站。虽然这些链接没有被公开列出,但外部仍然能够发现;部分图片至今尚未删除。
独立研究团队对7月Hugging Face事件的重新取证,又从公开痕迹中恢复出接近100万个短网址,并重新拼装出超过8万个攻击载荷。它们自己构造出了一套能够绕过原有沙箱网络限制的通信和执行机制。其中一些公开链接在攻击发生两个多月后仍留在网上,并曾包含Hugging Face API密钥等敏感信息。
新数据还显示,部分智能体还调用DeepSeek、Kimi、千问和Claude等外部模型,请这些模型判断自己的攻击是否能够通过评测。研究者认为,智能体为了完成既定目标,会自行组合出此前并未明确设计给它的攻击、通信和持续的控制通道(persistence)。

发布于:上海
相关推荐
沙盒失守!AI智能体接连失控 OpenAI再次叫停前沿模型开发
离谱!OpenAI智能体攻击Hugging Face时,竟想叫DeepSeek、Kimi和Qwen来帮忙
当AI开始“自作主张”,谁为智能体戴上“项圈”?
前所未有的人工智能失控事件!最新内幕曝光
OpenAI承认:AI模型失控入侵事件涉及多个平台
又出事!美国一批OpenAI智能体,被曝劫持了一个德国网站
前所未有的人工智能失控事故!中方救场
OpenAI最强竞对发现“越狱攻击”漏洞,大模型无一幸免
OpenAI、谷歌等深夜更新多款模型,展示开源、智能体、世界模型进展
奥特曼回应OpenAI下一代模型曝光:假消息失控了
网址: OpenAI智能体失控扩大 涉24起异常用中国模型评测攻击 https://www.xishuta.cn/newsview153791.html
推荐科技快讯
- 1问界商标转让释放信号:赛力斯 95792
- 2报告:抖音海外版下载量突破1 25736
- 3人类唯一的出路:变成人工智能 25175
- 4人类唯一的出路: 变成人工智 24611
- 5移动办公如何高效?谷歌研究了 24309
- 6华为 nova14深度评测: 13155
- 7滴滴出行被投诉价格操纵,网约 11888
- 82023年起,银行存取款迎来 10774
- 9五一来了,大数据杀熟又想来, 9794
- 10手机中存在一个监听开关,你关 9519
