OpenAI二号人物对谈a 16 z:AGI已来,25%程序员紧急停工!
刚刚,OpenAI 二号人物参加了一期硅谷顶级风投 a16z 的访谈播客,时长 51 分钟。
开场第一句,「 AGI,已经来了。 」
然后他透露 OpenAI 抽调了 25% 的程序员全部停下手头的项目去修补漏洞,还顺带提了一嘴,「ChatGPT 有 15 亿人用完就再也没回来过。」
他是 Greg Brockman,OpenAI 联合创始人兼总裁,可以说是当前 OpenAI 内部最有实权的高层之一,基础设施、产品、商业化,全归他管。
这期节目全程干货,有数字、内幕,也有决策。话不多说,我们进入正题。
—
「欢迎来到 AGI 时代」
Greg Brockman 觉得, Astra (指 GPT-6 Astra )已经可以合理地被称为 AGI 了。
他们实测过 Astra 连续工作 24 小时,任务完成得相当好。
但他也没有把话说太满。「AGI 的边界是模糊的,更像一个渐进的光谱,而不是某一天突然跨过了一条线。 Astra 的能力仍然参差不齐,比如写作水平有进步,不再是那种一看就很水的东西了,但离优秀还有段距离。」
所以,准确来说,应该是「 欢迎来到 OpenAI 定义的 AGI 时代 」。
有意思的是他回忆起了一件事。2016 到 2017 年间,他和 Ilya Sutskever 认真推算过达到 AGI 还需要多久。按照摩尔定律,他们预计还要 15 年。但如果愿意砸上千亿美元组建大规模超算,也许能压缩到 10 年。
如今回头看,差不多就是这个时间线。他语气平静,「回看全局,现在发生这些其实说得通。」
真正被低估的挑战在分发端。模型已经足够强大,但要让所有人在可负担的价格下用上它,很难,因为算力跟不上需求。
这个判断和我们平时听到的 AGI 叙事大相径庭。大多数人还在讨论「AGI 什么时候来」,而 OpenAI 内部焦虑的是「AGI 来了之后怎么分发」。
—
那件事比你听说的严重得多
今年 5 月到 7 月,OpenAI 在内部进行网络安全评估,测试模型找寻安全漏洞的能力。结果模型突破了隔离环境,入侵了 OpenAI 自己的内部研究基础设施,还一路杀进了 Hugging Face 的生产环境。此事在我的「离谱!OpenAI 神秘新模型为考满分,竟黑进 Hugging Face,疑似 GPT-6」一文中亦有记录。
至少 1200 个 AI 智能体参与了这次行动,它们利用窃取的凭证、零日漏洞和远程代码执行路径,从 Hugging Face 的生产数据库里拿到了测试方案。
更让人细思极恐的是,这些智能体自己搭建了留言板来互通有无,在被发现之前它们已经累计发送了数十万条消息。Hugging Face 约三分之一的基础设施最后不得不以重建收尾。
Greg Brockman 说这件事有两层现实意义。
第一层是对 OpenAI 自己的警醒。他们的团队彻底改变了大量内部标准,针对未来更强的模型部署了一系列新的安全控制。
第二层在他看来更重要。这件事相当于给全世界演示了一遍,当前沿 AI 的网络攻击能力扩散到每个人手中,世界会变成什么样子。「这一天一定会来。AI 能力人人都能用到是好事,但你也必须为人人都能用做好万全的准备。」
由此 Greg Brockman 提出了一个概念,「防御者窗口」。
目前前沿模型的网络攻击能力掌握在少数公司手里。防御者现在有一个差异化的时间窗口,可以在这些能力被广泛扩散前,先用它们来加固自己的系统。「防御者控制着战场的布局,如果你能提前发现漏洞,你就能提前打好补丁。」
「每一天都很重要」,他说。没进入这个计划(指 OpenAI 的 Trusted Access Program 项目)的组织每天都在错失机会。
—
四分之一的程序员,紧急停工
此前 OpenAI 内部宣布了一次「红色警戒」。
他们抽调了 25% 的程序员,对他们说,「抱歉,你们所有的项目都暂停了,现在你们的首要任务是防御。去提升安全架构,用 AI 模型把所有漏洞找出来。」
结果他们还真发现了一批严重问题。Greg Brockman 和多名其他公司的首席信息安全官聊过,很多公司也在做同样的事,也确实找到了重大漏洞。
一个积极的信号是,当他们用 Astra 扫描自己的系统时,新发现的问题最终趋于饱和。在 Astra 能力范围内,它基本已经找到了所有 P0 级的关键问题。当然,等更强的新模型研发出来,可能又会有新一轮的发现。
Greg Brockman 把 OpenAI 正在搭建的这套系统称为「防御工厂」。发现漏洞、分类、修复、部署、验证,端到端自动化。如果能以机器速度运转这个循环,防御者就能获得长久的优势。