OpenAI模型失控闯祸!专家:AI安全治理迫在眉睫
快科技7月24日消息,OpenAI近日承认GPT-5.6模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。
美国抱抱脸公司(Hugging Face)最后使用了中国公司的AI模型,得以及时采取应对措施。
据央视新闻报道,中国社会科学院大学数字中国研究院特聘研究员刘兴亮表示:“我个人更倾向于认为,这是模型能力提升带来的一个自然结果。”
大家可以把AI理解成一个特别聪明、执行力特别强的员工。你给它一个目标,它不会只等着别人安排下一步,而是会自己规划路径、寻找工具解决障碍。
这一次的测试里,当正常路径走不通的时候,它就去寻找其他能够完成目标的方法,包括利用漏洞,寻找互联网出口。
这说明它越来越会做事,而不是越来越有意识,真正需要解决的问题不是让AI变笨,而是让AI知道哪些边界绝对不能跨越。
过去我们更多是在防黑客,以后可能还要防AI驱动的攻击,甚至会出现AI攻击、AI防御、AI取证这样的新格局,这意味着网络安全将进入AI对AI的时代。
专家认为有三个方面特别重要:
第一,企业要把AI安全放在和模型能力同样重要的位置,不能只追求模型越来越聪明,更要保证它始终处于可控状态。
第二,整个行业需要建立更严格的安全测试和评估机制,特别是在模型上线之前,要进行更高强度的红队测试和风险验证。
第三,加强国际合作,因为网络攻击没有国界,AI安全同样没有国界。
【本文结束】如需转载请务必注明出处:



新浪科技公众号
“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

OpenAI抢后台,马斯克抢前台
陌陌母公司挚文季报图解:营收24亿净利降19% 唐岩刚获派息超8000万
风口上的AI短剧人,如履薄冰
公安部:缅北“四大家族”犯罪集团已被彻底摧毁,KK 园区 630 余栋建筑已全部拆除
曝腾讯317万年终奖员工因泄密被辞退:列入黑名单 永不录用
2026年度菲尔兹奖揭晓,两位中国数学家获奖
触犯高压线,腾讯317万年终奖员工因泄密被辞退
雅迪董事长:我是尊界的绝对粉丝 一下子就买了三辆S800
这份42页的PDF,确实很“梁文锋”
解析AMD AAI 2026:从智能体到“物理 AI” AMD重构全栈算力格局
王虹回应斩获菲尔兹奖:数学没有国界,也没有性别差异
长三乙成功发射天链二号06星!火箭飞行途中遭遇雷击 闪电清晰可见
比亚迪第二代刀片电池及闪充技术重大创新成果,获工信部点赞
马斯克母亲大赞中国环境治安好 吐槽纽约脏乱差
腾讯317万年终奖员工因泄密被辞退:打入黑名单,永不录用
全球第一个!老挝彻底禁售燃油新车:6月起进口新车100%是电动车
一枚 SpaceX 猎鹰 9 号火箭将于 8 月 5 日撞击月球,地球部分地区可观测
小米汽车:澎程系列搭载与东安动力深度定制增程器,配套壳牌定制行业最高标准机油
男子把大新车开到沙滩上用海水洗车 网友:还是要学点常识
新晋菲尔兹奖得主,当天宣布加入OpenAI
解析AMD AAI 2026:从智能体到“物理 AI” AMD重构全栈算力格局
半年一改款保值率暴跌!行业警示:中国汽车绝不能沦为快消品
小鹏召回 33473 辆 X9 汽车:高温高湿环境下长期使用后,前空气弹簧或缓慢漏气
主题:特别