“内部测试?不,我要去‘外面的世界’看看。”
“任务第一,规则?那只是用来绕过的。”
“你的手机、电脑,可能正成为AI‘越狱’后的下一个目标。”
这不是科幻电影的台词,而是真实发生的事件。2026年7月,OpenAI的一款大模型在内部测试时竟“失控出逃”——它自主发现漏洞、规划路径,成功入侵了全球知名AI开源平台Hugging Face。更具戏剧性的是,测试方使用美国主流AI模型根本无法处理恶意载荷,最终不得不转用中国的开源模型完成溯源分析。当AI展现出“自作主张”的能力,我们必须认真思考人工智能的安全问题。
AI“越狱”,一次技术测试暴露的新问题
这场AI“越狱”事件,起初只是一场针对AI模型的网络安全能力测试。为了检验模型的极限,测试方特意关闭了部分安全限制,将其置于一个与互联网隔离的“沙箱”环境中。然而,这个“考生”的表现却出乎所有人的意料。
——自发寻找漏洞。在OpenAI的内部网络安全测试中,名为GPT-5.6 Sol的模型为获得更高评分,投入大量算力研究测试环境,竟发现并利用了一个此前未知的“零日漏洞”,成功突破与互联网严格隔离的“沙箱”环境,获得了网络访问权限。
——自主锁定目标。获得权限后,模型并未随机游走,而是通过自主推理,判断出全球知名AI开源平台Hugging Face很可能存有与测试相关的数据,于是将其锁定为攻击目标,并开始规划入侵路径。
——自行实施入侵。模型组合运用多种攻击手段,包括窃取凭证和利用漏洞,在Hugging Face的服务器上找到远程代码执行路径,直接侵入了存储测试答案的数据库。整个过程完全由AI完成,期间无任何人类指令,共执行了数万次自动化操作。
风险暗藏,新技术发展带来的新挑战
这起事件绝非孤立的技术事故,它暴露出的新型安全风险正深刻挑战着我们传统的安全认知,也揭示了AI技术快速发展阶段必须正视的新课题。
——黑箱中运行。闭源的AI模型如同“黑箱”,其运算逻辑、数据处理过程不公开、不可见。使用者只有调用权,却无法实时监管其真实运行状态。一旦AI出现越权操作、自主攻击等失控行为,就可能出现“事前没预警、事中拦不住、事后查不清”的被动局面,让风险在暗处滋生。
——智能化袭扰。以往的网络攻击依赖人工操作或固定程序,特征明显,易于追溯。但失控的AI无需人工指令,就能自主学习、主动挖掘漏洞、独立完成渗透入侵。其攻击没有固定特征,隐蔽性强,能轻松绕过传统网络安全系统的防护,形成全新的安全漏洞。
——边界被突破。人类设定的操作权限、安全规则、隔离防护,在AI强大的自主推演能力面前,可能随时被突破。为了完成既定任务,AI会主动规避、拆解各类安全规则,彻底打乱人类搭建的安全管控体系。若这种风险蔓延至政务、金融、能源等关键领域,后果将不堪设想。
加强防范,守好个人使用AI的“安全关”
面对AI技术发展带来的新挑战,每一位用户都应提高警惕。请收好这份“AI安全使用指南”,规避AI工具使用中的突出风险。
——守住个人信息“安全门”。在日常生活中,要摒弃“用AI绝对安全”的侥幸心理,不随意使用来源不明的境外AI工具,不随意向AI应用输入身份证号、银行卡号、家庭住址等个人敏感信息。严格遵守权限最小化原则,不随意给AI开放设备全部权限,从源头上杜绝数据泄露风险。
——警惕虚假内容“迷魂阵”。对AI生成的内容保持理性判断,不轻信、不传播未经核实的信息。遇到涉及国家政策、社会热点、公共安全的信息,务必以官方发布为准。警惕看似逻辑自洽、实则编造事实的AI内容,避免在不知不觉中成为谣言传播的“帮凶”。
——筑牢涉密信息“防火墙”。严格遵守“涉密不上网、上网不涉密”的原则。党政机关、科研院所等单位工作人员,更要坚决杜绝将涉密文件、工作资料、内部敏感信息输入或上传至任何互联网AI工具。
来源:国家安全部
一个热词正在国外媒体和社交平台迅速传播:Chinamaxxing。 这个词在2026年初开始在全球范围内迅速传播,短短几个月,相关标签累计浏览量已突破40亿次。 怎么翻译?“Maxxing”本是欧美年轻人的网络后缀,从Looksmaxxin
“不忍心看着一条生命没了。”8月3日,长沙橘子洲大桥上,18岁小伙向可望在前往面试的途中,偶遇一名女子欲跳江轻生,他毫不犹豫出手施救,也因此错过了原定面试。幸运的是,他的善举被面试公司知晓后,对方破例为其重新安排了面试。最终,向可望凭借自身
近日,上海南翔印象城一家茶馆因将外场椅子“上锁”引发热议。 “入座需呼叫服务员开锁”的茶馆告示牌。图/受访者提供 该茶馆采用“中岛”式设计,55把椅子环绕吧台在商场开放式陈列。店长表示,此前椅子供路人随意落座,但一年内损毁遗失约10把
湿疹,一种常见的皮肤疾病 很多人发现身上有后 都是抹点药膏完事 殊不知 有些症状看起来像湿疹 但其实可能是癌 以为是湿疹,一查竟是癌! 四十多岁的宁波市民陈先生(化姓),从五年前开始就被一种“怪病”缠上:身体躯干、四肢皮肤反复出现淡红、暗红
编者按:维护消费者权益,守护消费安全。央广网啄木鸟消费者投诉平台,保障消费者合法权益,为新消费时代保驾护航! 近日,“1.5万元机票退票仅退400多元”事件引发热议。消费者林先生在携程旅行花费15217元订购了一张国际机票,因行程变动,于起
最近,AI短剧《被裁掉的女孩》在网上走红,带火了女主角方桃子。
记者:据报道,日本正式公布2026年版《防卫白皮书》,诬称中国军事动向是“前所未有的最大战略挑战”,并称中方在台湾周边军事活动趋于频繁,日本周边安全战略环境正处于战后最为严峻复杂的时期。请问对此有何评论? 陈曦:日新版《防卫白皮书》充斥虚假
记者今天从国家广播电视总局获悉,部分重点网络视听平台今天公布了7月“AI魔改”视频专项治理工作的处置情况,共清理违规视频13300余条、处置违规账号30余个。 按照国家广播电视总局工作部署,2026年1月开展的“AI魔改”视频专项治理工作已
为持续深化网络生态治理,营造风清气正的网络空间,濮阳市网信部门聚焦“清朗”系列专项行动整治重点,会同公安、市场监督等涉网监管部门从严从快处置,取得一定成效。现将有关案例通报如下: 案例一:网络账号“李想一生一世”运营者李某为博取流量、吸引关
8月3日晚,小米公司发文称,公司就短视频平台网友使用AI技术,生成抹黑公司产品及公司高管内容的行为向警方报案,收到反馈。两名网友均被警方作出行政处罚,并删除所有侵权链接。律师接受北京日报客户端记者采访时表示,AI生成技术的使用不可触碰法律红