安全
分类
防护措施
OpenAI介绍称,这些安全防护措施需要消耗相当可观的算力。
文章
OpenAI首席科学家雅库布·帕乔茨基周二在记者会上表示:“我们确实预计这些模型的能力提升速度会比过去快得多,正因如此,我们才更加重视加强安全防护措施。
文章
具体的操作方面,OpenAI现在要求涉及Astra模型或更先进AI模型的工作负载必须采用最严格的安全防护措施。
文章
能力
具体来说,OpenAI表示近几周出现的两项进展(开发中的前沿模型失控攻击外部第三方公司的数据库,以及即将推出Astra模型可能已经达到“关键网络安全能力”门槛),再加上内部研究的快速推进,都使得公司更加迫切地需要在训练流程的各个阶段,加强监控、对齐和隔离防护措施。
文章
OpenAI曾在8月7日宣布,即将推出的Astra模型可能已经达到《准备框架》的网络安全能力关键阈值,因此将暂停开展未达到强化安全控制要求的Astra相关活动。
文章
其中网络安全能力的“关键”阈值,指的是AI模型无需人工干预,便能在许多经过强化的现实关键系统中识别并开发出各种严重级别的有效“零日漏洞”;
文章