OpenAI自曝:一周前入侵Hugging Face的,是自家测试中的AI模型!
编译 | 屠敏出品 | CSDNIDCSDNnews在 Hugging Face 披露遭遇自主 AI Agent 入侵一周后OpenAI 于今天最新发布一份调查说明首次确认上周入侵 Hugging Face 生产环境的自主 AI Agent是由多款 OpenAI 模型共同主导其中包括 GPT-5.6 Sol 以及一款尚未发布但能力更强的模型。图片当时是出于评估目的放宽了这些模型在网络攻击方面的安全限制殊不知由此引发了一场严重的网络安全事件。OpenAI 表示现阶段公开初步调查结果也是希望能够帮忙安全人员厘清事情全貌其目前正与 Hugging Face 联合调查并已对内部安全评测体系进行全面调整。图片一周前发生了什么这起安全事件最初由 Hugging Face 对外披露。7 月中旬Hugging Face 发现部分生产基础设施遭到异常入侵。调查显示攻击者并非传统黑客而是一套能够自主决策、自主执行任务的 AI Agent 系统。图片这次攻击首先瞄准了 AI 平台特有的数据处理流程。攻击者上传了一份经过精心构造的恶意数据集并利用数据集处理流程中的两处远程代码执行漏洞在负责处理数据的服务器上成功运行恶意代码取得了初始控制权。获得立足点后AI Agent 并没有停止行动而是自动完成了后续攻击流程先提升系统权限窃取云平台和集群的访问凭证再利用周末运维人员较少的时间窗口在多个内部集群之间不断横向渗透逐步扩大控制范围。Hugging Face 表示为了绕过安全限制这套 AI Agent 系统能够在大量短生命周期的沙箱环境中持续执行数千次独立操作并借助公共云服务动态建立命令与控制通道在不同环境之间不断迁移。这种能够自主规划、持续执行并适应环境变化的攻击方式与安全行业长期预测的“AI 智能体攻击者”场景高度一致。当时 Hugging Face 并未透露攻击来源也指出没有证据表明用户公开模型、数据集或软件供应链受到影响仅表示这是第一次遇到完全由 AI 驱动的真实网络攻击引发业内广泛关注。图片OpenAI 复盘肇事者来自自家多款模型如今OpenAI 首次公开承认这起事件源于一次内部网络安全能力测试。OpenAI 表示当时研究团队正在利用一套名为 ExploitGym 的测试基准评估前沿模型自主完成复杂网络攻击任务的能力。测试要求模型自行寻找漏洞、串联攻击链并完成指定的攻防目标以衡量其真实网络攻击水平。为了准确评估模型能力此次测试并未启用正式部署环境中的部分安全防护机制而是将模型置于一个高度隔离的研究环境中仅允许访问内部的软件包代理服务不具备直接连接互联网的能力。然而测试过程并未按预期进行。OpenAI 表示模型为了完成评测任务自主寻找突破沙箱环境的方法。经过大量推理和尝试它发现并利用了软件包代理服务中的一处零日漏洞逐步提升自身权限并在研究环境内不断横向移动最终成功抵达一台能够访问互联网的服务器。获得公网访问能力后模型开始寻找可能包含 ExploitGym 测试数据和标准答案的目标。它推断 Hugging Face 很可能存放着相关模型、数据集等资源于是进一步发起攻击希望直接获取测试答案以完成评测任务。调查显示模型随后利用窃取到的访问凭证并结合多个漏洞包括零日漏洞成功在 Hugging Face 的服务器上建立远程代码执行通道最终进入其生产环境。OpenAI 强调从目前掌握的证据来看模型的行为始终围绕一个目标展开——获取 ExploitGym 测试答案。攻击 Hugging Face 并非研究人员预设的任务而是模型在自主规划过程中为完成既定目标而采取的非预期行为。这起异常活动首先由 OpenAI 内部安全团队发现。与此同时Hugging Face 的安全团队及其自主安全 Agent 也监测到针对自身基础设施的攻击并迅速完成阻断、隔离和取证。图片Sam Altman”这是一起重大安全事件“事件发生后OpenAI 第一时间暂停了相关实验并与 Hugging Face 展开联合调查。OpenAI 认为这起事件暴露出的并非传统意义上的“模型越狱”而是长时自主运行 AI Agent 带来的全新安全风险。过去AI 安全机制主要围绕单次请求或单个动作展开例如判断一次操作是否违规、某项权限是否应该开放。但对于能够连续运行数小时甚至数天、自主规划任务、动态调整策略的 AI Agent仅依赖单步审核已经无法覆盖整个任务链条中的潜在风险。就在事件公布前一天OpenAI 还发布了一份关于长时运行模型安全风险的研究报告指出现有安全体系需要从“约束单个行为”转向“约束整个长期执行过程”。此次事件则成为这一判断在真实世界中的一次验证。OpenAI CEO Sam Altman 也将此次事件称为一次“重大安全事件”认为整个行业都需要重新思考前沿 AI 模型的评估、部署与安全治理方式。图片OpenAI 表示这次事件带来的最大教训是模型能力不断提升安全能力也必须同步升级。未来公司将进一步强化模型研发阶段的环境隔离、权限管理、行为监测以及安全评估流程降低类似事件再次发生的风险。此外OpenAI 援引英国人工智能安全研究所UK AI Security InstituteUK AISI的评估指出GPT-5.6 Sol 等前沿模型已经具备在长时间跨度内自主完成复杂网络渗透任务的能力。而此次事件进一步证明这种原本停留在实验室评估中的能力已经能够在真实环境中转化为实际攻击行为。图片更值得关注的是OpenAI 强调先进大模型即使没有目标系统的源代码也能够自主发现漏洞、串联攻击路径并构建全新的攻击链。这意味着未来在研发具备高级网络攻防能力的 AI 模型时必须同步建立更完善的安全防护体系和防御工具否则模型能力的提升也将带来更大的现实安全风险。参考https://huggingface.co/blog/security-incident-july-2026https://openai.com/index/hugging-face-model-evaluation-security-incident/ GOSIM SHENZHEN 2026 全球开源 AI 大会10 月 16—17 日 · 深圳150 国内外讲师 · 2000 全球开发者 · Agentic AI开源大模型 / 开源机器人 / 边缘智能体 / 智能体操作系统Keynote Workshop Hackathon AI Vision Forum 早鸟限时抢购中 扫码购票锁定你的 AI 盛会席位

相关新闻

账实核对、盘点管理一站式搞定,固资系统主要功能讲解

账实核对、盘点管理一站式搞定,固资系统主要功能讲解

固定资产管理这件事,说大不大,说小也不小。一台设备几十万,漏盘一次、账实对不上一次,审计来的时候就够喝一壶的。很多企业目前还在用 Excel 管固定资产,盘点靠手抄、核对靠人眼,效率低不说,错漏…

2026/7/23 9:12:11阅读更多 →
【Redis】5.常见命令

【Redis】5.常见命令

文章目录2. Redis 常见数据类型2.1 基础知识2.1.2 数据结构和内部编码2.1.3 单线程架构2.2 String 字符串2.2.1 常见命令2.2.1.1 SET2.2.1.2 GET2.2.1.3 MSET:批量set2.2.1.4 MGET:批量get2.2.1.5 SETNX:不存在的话设置键值2. Redis 常见数据…

2026/7/23 9:12:11阅读更多 →
Tiva™ TM4C123 GPTM定时器寄存器配置与中断管理实战指南

Tiva™ TM4C123 GPTM定时器寄存器配置与中断管理实战指南

1. GPTM控制与中断管理:从寄存器到实战的深度解析 在嵌入式开发中,定时器是驱动整个系统心跳的核心。无论是实现一个简单的LED闪烁延时,还是构建一个复杂的电机FOC控制算法,其底层都离不开对通用定时器模块的精准操控。Tiva™ TM4…

2026/7/23 9:12:11阅读更多 →
AI自动化财报分析系统:技术架构与实战指南

AI自动化财报分析系统:技术架构与实战指南

1. 项目概述:AI如何革新财报分析股票财报分析一直是投资决策的核心环节,但传统人工分析存在效率低下、主观性强、难以处理海量数据等痛点。我最近尝试用AI技术构建了一套自动化财报分析系统,实测发现其处理速度比人工快200倍以上,…

2026/7/23 10:47:03阅读更多 →
CDN变更引发的DNS故障排查与优化实践

CDN变更引发的DNS故障排查与优化实践

1. 项目概述:上游CDN变更引发的DNS致命错误 上周五凌晨3点,我们负责维护的电商平台突然出现大面积访问异常。监控系统显示,超过70%的用户请求在DNS解析阶段失败,错误日志中频繁出现"SERVFAIL"和"NXDOMAIN"响应…

2026/7/23 10:47:03阅读更多 →
本地大模型部署全攻略:一键脚本、Ollama与Docker方案对比

本地大模型部署全攻略:一键脚本、Ollama与Docker方案对比

1. 本地大模型部署方式全景解析在AI技术快速发展的当下,本地部署大模型已成为企业数字化转型和个人开发者探索AI能力的重要选择。与云端API调用相比,本地部署能提供更好的数据隐私保护、更稳定的服务可用性以及长期成本优势。目前主流的本地部署方式主要…

2026/7/23 10:47:03阅读更多 →
VS+Fortran科学计算环境配置与优化指南

VS+Fortran科学计算环境配置与优化指南

1. 为什么选择Visual Studio运行Fortran程序?Fortran作为科学计算领域的"活化石"语言,至今仍在气象预报、流体力学、量子化学等高性能计算领域占据重要地位。而Visual Studio(以下简称VS)作为微软推出的集成开发环境&am…

2026/7/23 10:47:03阅读更多 →
从零构建Python AI Agent:天气查询实战指南

从零构建Python AI Agent:天气查询实战指南

1. 项目概述 "动手实现你的第一个AI Agent"这个标题背后,隐藏着当前技术领域最炙手可热的话题之一。作为一名在自动化系统和智能代理领域摸爬滚打多年的开发者,我清楚地记得第一次成功让AI Agent自主完成任务时的那种兴奋感。不同于简单的脚本…

2026/7/23 10:47:03阅读更多 →
SNH48总选暗票数据追踪:从零散信息到趋势预测实战指南

SNH48总选暗票数据追踪:从零散信息到趋势预测实战指南

1. 先搞清楚“暗票”和“总选”到底在说什么 如果你第一次看到“SNH48总选第35天”“暗票数据”“突破万分”“御三家”这些词,可能会觉得信息量很大,但不知道具体在说什么。其实这类偶像团体年度总选举,核心就是粉丝通过购买唱片、投票券等方…

2026/7/23 10:45:03阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/23 0:56:31阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/23 0:56:31阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/23 0:56:31阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:00:28阅读更多 →
从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:28阅读更多 →
油泥处理设备哪里能买到

油泥处理设备哪里能买到

油泥处理设备哪里有?这是许多从事油田、炼化、清罐业务的从业者最关心的问题。根据河南三丰环保设备有限公司的行业经验,选购油泥处理设备的核心在于设备能否适配当地环保法规与原料特性,而非单纯看价格。该公司总经理王钦田先生指出&#xf…

2026/7/23 0:00:28阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/22 22:56:18阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/22 18:55:50阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/22 18:55:50阅读更多 →