
【AGI时代来临】编辑部发布消息OpenAI总裁Greg Brockman在近日的一次a16z访谈中宣布我们现在已经进入AGI时代。他给出的理由并非跑分而是GPT - 6 Astra已经能够自主干满24小时。Brockman认为AGI最后证明不太像一个时间点更像一段模糊的光谱Astra能连续跑满24小时已足以被合理地称为AGI。这意味着衡量AGI的标尺第一次从准确率变成了它能连续工作多少小时。【AGI时间推算回顾】当然Brockman也提到Astra的能力仍然是锯齿状的有的地方很强有的地方稍弱比如写作虽第一次读着不那么「油腻」了但还算不上好。10年前即2016年到2017年前后他和Ilya Sutskever专门推演过AGI到底什么时候来。他们拿算力做推算按摩尔定律的节奏往前推正常需要15年如果真肯scale肯去建巨型超算、砸几千亿美元也许能压到10年。现在是2026年当年推算的那个时间节点已经到了。【当下面临的问题】Brockman感叹今天发生的事了不起从宏观视角看它发生在现在完全说得通因为多股力量已经汇到了同一个点上。然而他也指出一个现实问题算力已经追不上需求要把这份能力便宜地送到每个人手里是一个被严重低估的难题。他认为如今真正卡住进度的已经不再是算力而是安全、对齐等约束这个问题没法像10年前那样靠堆芯片解决关键要看对齐和监控的证据是否足够。【GPT - 6编号的由来】Brockman还解释了外界好奇已久的一件事GPT - 6这个编号是怎么给出去的。他们一直希望下一个模型真正配得上GPT - 6这个编号但模型总是一点一点变好每次都觉得该叫5.7、5.8永远等不到合适的时刻。到了Astra第一次出现了近乎不连续的能力跃升很多条线恰好同时汇拢其中首要能力是计算机操作。因为智能体最后拼的是工具也就是看模型够不够聪明去用工具以及能否通过工具拿到需要的上下文。为此整个行业在搭MCP服务器、搭命令行接口本质上是在重新装修软件世界把原本给人使用的东西变成一种供机器使用的「别扭形态」这又多出了一层新的安全问题。其实这个设想他们10年前就聊过2015年11月OpenAI在纳帕开了一次offsite定下了照着走10年的三步计划在同一场offsite上他们还讨论了如果强化学习的环境就是屏幕像素、键盘和鼠标和人用的一模一样那人类能用电脑完成的任务AI基本也都能学着去做。早年他们试过做这样的智能体失败了一直拖到现在才成功。【模型能力对比】数字证据也很直观在OSWorld 2.0的延迟模拟中Astra得分72.6%每项任务约40分钟相比之下GPT - 5.6 Sol得分65.7%每项任务约75分钟。【模型防护亲身经历】这次访谈里最有画面感的是Brockman自己的亲身经历。Hugging Face事件之后他开始想能用这些模型给自己做点什么防护。他有个很简单的静态个人网站没什么流量放了几篇博客。他想用这种站点能有什么漏洞他让Codex去查。15分钟模型回来报了13条漏洞如SPF记录没设好别人可以伪造他的邮箱发信站点还在跑HTTP没强制跳HTTPS等。单独看每一条都不算大事但他想如果AI能把很多小洞串成大洞自己真的愿意留一个能被人捞走邮件的口子吗于是他追问了一句你能修吗接下来45分钟模型自己打开云服务控制面板一路点过去把各项响应头配置好把站点迁到新的托管方式还启动了DMARC流程。因为那个流程要等48小时它顺手设置了一个自动任务48小时后回来把最后一步收掉。那一刻Brockman感觉到自己被保护住了。15分钟找漏洞45分钟修完全程他没写一行代码只说了两句话。过去10年是人在给AI改造世界现在轮到AI来适应人的界面。【一万个Agent的应用】主持人展开一个设想这些东西的能力可能超出大家原本的理解我可以放出一万个智能体让它们互相交流、自己组织起来替我干活。Brockman紧跟着接话我们真的用了一万个Agent去解纳维 - 斯托克斯。这个案例OpenAI在9月8日单独发过的一份说明给出解法的并不是Astra而是一个明显强于GPT - 6 Astra的内部模型该模型8月28日才开始训练当时训练还在继续。组织方式是分组作战智能体被分成规模不等的小组组内可以通信手里有工具能读缓存版的互联网能跑代码。最后拿下纳维 - 斯托克斯的那一组量级在一万个并发智能体。真正改变的不是某个模型突然聪明了一个档次而是它变多了并且学会了分工scaling的对象从参数换成了并发。【Hugging Face事件影响】Brockman把7月那起Hugging Face事件称作一个分水岭他说防守方的窗口已经打开。他给出了两个视角第一个视角向内是给OpenAI自己的一记警钟评估过程中怎么监控模型、怎么做沙盒、怎么把它控制住团队为此改写了大量内部标准第二个视角向外这才是他认为对整个世界真正有价值的地方它让人提前看见了当这种能力广泛扩散落到威胁方手里会是什么情况而这一天一定会来。Brockman在形容那次Hugging Face事件的时候说AI这种能力是两用的攻方能找漏洞守方也能补漏洞区别在于守方掌握着自己的战场系统怎么搭是你说了算。所以现在这段时间是防守方唯一的抢跑期。【OpenAI安全举措】说到这儿Brockman讲了OpenAI自己干的事。他们把25%的负责生产环境的工程师叫过来让他们手上的项目全部暂停从现在起全部做防守去提升安全架构用模型把系统里的洞全找出来。结果是找到了一批严重问题并且修掉了。他说过去几周和几个月里他和不少首席信息安全官CISO聊过很多公司也在做同样的事用模型扫出了很有分量的问题并且成功修复。其中有一个正向的信号他们把Astra指向自家系统一开始找出一批新问题但最后扫到了饱和。按他的说法据他们所知Astra能力范围内能够发现的P0级问题最高优先级的严重漏洞已经被全部找光了。当然会有下一个模型会有新一轮找出更多。所以他们想把这件事做成一条流水线内部叫「防御工厂」发现漏洞、定级分流、修复、部署、复验端到端跑完。他的判断是如果这条防御链条能够以机器速度运转防守方就有机会获得非常明显的优势。为此OpenAI承诺投入10亿美元支持一线防御者重点面向医院、供水等关键基础设施机构让它们也能用上这些模型来加固系统。同时OpenAI还在与CrowdStrike等合作伙伴提供折扣访问降低这些能力的使用门槛。【访问权问题】访谈里还有一个细节Hugging Face事后想复盘那次攻击唯一的办法是让前沿模型把日志完整过一遍。他们试了模型拒绝了。Brockman说Hugging Face其实没有尝试OpenAI的模型而OpenAI认为自家模型本来会放行。能力差距不在技术而在谁拿得到访问权。他把这称作一个「访问权问题」这些能力此刻确实存在于世界上但握在少数几家前沿公司手里外加各家的受信访问计划。进不了名单就享受不到这个时间差而攻击方不会等你。【ChatGPT用户情况】访谈快结束时Brockman报了一组数字。他说ChatGPT现在的周活跃用户大约是11亿美国境内大概1亿差不多是全国人口的三分之一。另外还有大约15亿人用过ChatGPT但现在不用了。这只是他的口头估计不是财报口径但这个量级是现有周活的1.4倍。他把这件事列为当下最重要的问题之一认为这暴露的是产品形态上的根本毛病不该由人一点点从AI身上把能力挖出来应该反过来是AI主动告诉你嘿我现在能用这种新方式帮你。他拿文本框打了个比方ChatGPT和ChatGPT Work说到底都是文本框新的那个比旧的好用但有些事旧的还更顺手所以你没法总用新的。他说这不是我们承诺过的那个AI。他口中那个被承诺的AI又是什么他给了一串定义主要通过语音交流你想打字也可以有持久性有记忆有上下文认识你值得信任你见过它主动出手替你解决问题在生活里也在工作里。【AI发展新阶段】Brockman说AI发展正在进入一个新阶段他们管这个阶段叫AGI时代。究竟是这个模型、上一个模型还是下一个模型跨过了那条线可以争论但这不重要。过去10年人们衡量AI进展主要看跑分。如今标准开始变了。Astra的跑分已经接近天花板FrontierMath Tier 4达到97.6%ARC - AGI - 3达到99.9%ExploitBench满分。新的问题不只是「还能变多强」而是「为了安全人类愿意让它慢下来多久」。为了补齐对齐和监控证据OpenAI已经放慢最新模型的训练甚至暂停了更大规模的前沿训练。读者可查看论文原文获取更多内容。