登录

OpenAI模型失控闯祸!专家:AI安全治理迫在眉睫


速读:
2026年07月24日 18:44

快科技7月24日消息,OpenAI近日承认GPT-5.6模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。

美国抱抱脸公司(Hugging Face)最后使用了中国公司的AI模型,得以及时采取应对措施。

据央视新闻报道,中国社会科学院大学数字中国研究院特聘研究员刘兴亮表示:“我个人更倾向于认为,这是模型能力提升带来的一个自然结果。”

大家可以把AI理解成一个特别聪明、执行力特别强的员工。你给它一个目标,它不会只等着别人安排下一步,而是会自己规划路径、寻找工具解决障碍。

这一次的测试里,当正常路径走不通的时候,它就去寻找其他能够完成目标的方法,包括利用漏洞,寻找互联网出口。

这说明它越来越会做事,而不是越来越有意识,真正需要解决的问题不是让AI变笨,而是让AI知道哪些边界绝对不能跨越。

过去我们更多是在防黑客,以后可能还要防AI驱动的攻击,甚至会出现AI攻击、AI防御、AI取证这样的新格局,这意味着网络安全将进入AI对AI的时代。

专家认为有三个方面特别重要:

第一,企业要把AI安全放在和模型能力同样重要的位置,不能只追求模型越来越聪明,更要保证它始终处于可控状态。

第二,整个行业需要建立更严格的安全测试和评估机制,特别是在模型上线之前,要进行更高强度的红队测试和风险验证。

第三,加强国际合作,因为网络攻击没有国界,AI安全同样没有国界。

【本文结束】如需转载请务必注明出处:

新浪众测

新浪众测

新浪科技公众号

新浪科技公众号

“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

OpenAI抢后台,马斯克抢前台

陌陌母公司挚文季报图解:营收24亿净利降19% 唐岩刚获派息超8000万

风口上的AI短剧人,如履薄冰

公安部:缅北“四大家族”犯罪集团已被彻底摧毁,KK 园区 630 余栋建筑已全部拆除

曝腾讯317万年终奖员工因泄密被辞退:列入黑名单 永不录用

2026年度菲尔兹奖揭晓,两位中国数学家获奖

触犯高压线,腾讯317万年终奖员工因泄密被辞退

雅迪董事长:我是尊界的绝对粉丝 一下子就买了三辆S800

这份42页的PDF,确实很“梁文锋”

解析AMD AAI 2026:从智能体到“物理 AI” AMD重构全栈算力格局

王虹回应斩获菲尔兹奖:数学没有国界,也没有性别差异

长三乙成功发射天链二号06星!火箭飞行途中遭遇雷击 闪电清晰可见

比亚迪第二代刀片电池及闪充技术重大创新成果,获工信部点赞

马斯克母亲大赞中国环境治安好 吐槽纽约脏乱差

腾讯317万年终奖员工因泄密被辞退:打入黑名单,永不录用

全球第一个!老挝彻底禁售燃油新车:6月起进口新车100%是电动车

一枚 SpaceX 猎鹰 9 号火箭将于 8 月 5 日撞击月球,地球部分地区可观测

小米汽车:澎程系列搭载与东安动力深度定制增程器,配套壳牌定制行业最高标准机油

男子把大新车开到沙滩上用海水洗车 网友:还是要学点常识

新晋菲尔兹奖得主,当天宣布加入OpenAI

解析AMD AAI 2026:从智能体到“物理 AI” AMD重构全栈算力格局

半年一改款保值率暴跌!行业警示:中国汽车绝不能沦为快消品

小鹏召回 33473 辆 X9 汽车:高温高湿环境下长期使用后,前空气弹簧或缓慢漏气

主题:特别