爱游戏官网 IGAME 平台 - 官方游戏入口

客服在线时间:

每日 8:00—22:00(含法定节假日)

[email protected]

+86 +86 159 2267 4267

OpenAI总裁:AGI时代来了,GPT-6已能自主干活24小时

OpenAI总裁Greg Brockman在近期参与a16z访谈时表示,AGI时代已经来临。

他给出的依据并非模型跑分,而是GPT-6 Astra已能连续自主工作24小时。Brockman指出,AGI的界定更像一段模糊光谱,而非一个明确的时间点。

在他看来,Astra能连续运行一整天,已足以合理称之为AGI。衡量AGI的标准首次从准确率转向模型能持续工作的小时数。当然,他也承认Astra的能力存在不均衡,某些领域表现突出,而另一些则稍显不足——例如写作,虽然不再那么“油腻”,但距离优秀仍有差距。

10年前,他与Ilya曾推算过时间节点

Brockman回忆,在2016至2017年间,他与Ilya Sutskever曾专门推演AGI到来的时间。他们基于算力进行推算:按摩尔定律节奏,正常发展需15年;若肯大规模扩展,建造巨型超算并投入数千亿美元,或许能压缩至10年。

如今已是2026年,十年过去,当年推算的时间点已然到来。Brockman感叹,当前发生的一切固然了不起,但从宏观视角看,这完全合情合理,因为多股力量已汇聚至同一节点。

然而,他也提出一个现实问题:算力已无法满足需求。将这种能力以低成本普及至每个人,是一个被严重低估的挑战。Brockman表示,他们必须认真考虑如何把握前沿推进的节奏。

随着模型能力增强,安全与对齐等标准需不断提升,而这些已成为进度瓶颈,需要投入大量精力去完善。他认为,如今真正制约进展的不再是算力,而是安全、对齐等约束。这个问题无法像10年前那样靠堆砌芯片解决,关键在于对齐与监控证据是否充分。

纳帕那次offsite,与他个人网站上的13个漏洞

Brockman还解释了外界长期好奇的问题:GPT-6这个编号如何确定。他们一直希望下一个模型能真正配得上这个编号,但模型总是逐步改进,每次感觉应命名为5.7或5.8,始终找不到合适时机。

直到Astra,才首次出现近乎不连续的能力跃升,多条发展线恰好同时汇聚。他特别点名计算机操作能力,因为智能体最终比拼的是工具使用——模型是否足够聪明去利用工具,以及能否通过工具获取所需上下文。为此,整个行业在搭建MCP服务器和命令行接口,本质上是在重塑软件世界,将原本为人设计的界面改造成适合机器使用的形态。

这仿佛是在为世界重新装修,而这一层又带来了新的安全问题。实际上,这个设想他们10年前就已讨论过。

2015年11月,OpenAI在纳帕举行了一次offsite,制定了为期10年的三步计划。同一场会议上,他们还讨论了若强化学习环境与人类使用的屏幕像素、键盘和鼠标完全一致,那么人类能用电脑完成的任务,AI基本也能学会。早期他们尝试构建这样的智能体,但失败了,直到最近才成功。

数字证据也很直观:在OSWorld 2.0的延迟模拟中,Astra得分72.6%,每项任务约40分钟;而GPT-5.6 Sol得分65.7%,每项任务约75分钟。

访谈中最具画面感的,是Brockman的亲身经历。Hugging Face事件后,他开始思考如何用这些模型保护自己。他有一个简单的静态个人网站,流量不大,仅放了几篇博客。Brockman想,这种站点能有什么漏洞?他让Codex去检查。15分钟后,模型返回了13条漏洞:SPF记录未设置,他人可伪造他的邮箱发信;站点仍运行HTTP,未强制跳转HTTPS……

单独看每一条都不算严重,但他想,若AI能将许多小漏洞串成大问题,自己是否愿意留下一个能被他人窃取邮件的入口?于是,他追问了一句:你能修吗?

接下来的45分钟,模型自行打开云服务控制面板,逐一配置各项响应头,将站点迁移至新托管方式,并启动了DMARC流程。由于该流程需等待48小时,模型还顺手设置了一个自动任务,48小时后回来完成最后一步。那一刻,Brockman感到自己被保护了。15分钟找漏洞,45分钟修复,全程他未写一行代码,只说了两句话。过去10年,是人类在为AI改造世界;现在,轮到AI来适应人类的界面。

一万个Agent与一段留给防守方的抢跑期

主持人展开了一个设想:这些能力可能超出大家原本理解,可以放出一万个智能体,让它们互相交流、自行组织起来执行任务。Brockman紧接着接话:他们确实用了一万个Agent去解纳维-斯托克斯方程。

这个案例,OpenAI在9月8日单独发布过说明,给出解法的并非Astra。他们使用的是一个明显强于GPT-6 Astra的内部模型,该模型于8月28日开始训练,当时训练仍在进行。组织方式为分组作战:智能体被分成规模不等的小组,组内可通信,配备工具,能读取缓存版互联网并运行代码。最终解决纳维-斯托克斯方程的那一组,量级达到一万个并发智能体。

真正改变的不是某个模型突然聪明了一档,而是它变多了,并学会了分工。scaling的对象从参数转向了并发。

Brockman将7月的Hugging Face事件称为分水岭,认为防守方的窗口已经打开。他给出了两个视角:向内,是对OpenAI自身的警钟,团队为此重写了大量内部评估标准,以监控模型、构建沙盒并控制其行为;向外,是对整个世界的价值——它让人提前看到,当这种能力广泛扩散并落入威胁方手中时会发生什么,而这一天必然会到来。

Brockman形容,AI这种能力是双刃剑:攻击方能找漏洞,防守方也能补漏洞,区别在于防守方掌握着自己的战场,系统如何搭建由你决定。因此,当前这段时间是防守方唯一的抢跑期。

OpenAI抽调25%工程师做安全

Brockman还讲述了OpenAI自身的行动。他们抽调了25%负责生产环境的工程师,暂停所有项目,全部转向防守,提升安全架构,利用模型找出系统漏洞。结果发现了一批严重问题并成功修复。

他说,过去几周和几个月里,他与不少首席信息安全官(CISO)交流,许多公司也在做同样的事,用模型扫出了有分量的问题并成功修复。其中有一个正向信号:他们将Astra指向自家系统,最初发现一批新问题,但最终扫描达到饱和。据他们所知,Astra能力范围内能发现的P0级问题(最高优先级严重漏洞)已被全部找光。当然,下一个模型会带来新一轮扫描,发现更多漏洞。

因此,他们希望将此事做成一条流水线,内部称为“防御工厂”:发现漏洞、定级分流、修复、部署、复验,端到端完成。Brockman判断,若这条防御链条能以机器速度运转,防守方就有机会获得显著优势。为此,OpenAI承诺投入10亿美元支持一线防御者,重点面向医院、供水等关键基础设施机构,让它们也能使用这些模型加固系统。同时,OpenAI还与CrowdStrike等合作伙伴提供折扣访问,降低能力使用门槛。

访谈中还有一个细节令人深思。Hugging Face事后想复盘那次攻击,唯一办法是让前沿模型完整过一遍日志。他们尝试了,但模型拒绝了。Brockman表示,Hugging Face其实未尝试OpenAI的模型,而OpenAI认为自家模型本会放行。能力差距不在技术,而在谁拿得到访问权。他将此称为“访问权问题”:这些能力此刻确实存在于世界上,但仅握在少数几家前沿公司手中,外加各家的受信访问计划。进不了名单,就享受不到这个时间差,而攻击方不会等你。

那15亿走掉的人

访谈接近尾声时,Brockman报了一组数字。ChatGPT当前周活跃用户约11亿,美国境内约1亿,接近全国人口的三分之一。然后,他提到:另有约15亿人,用过ChatGPT但现在不用了。这只是他的口头估计,非财报口径,但该量级是现有周活的1.4倍。

他将此事列为当下最重要问题之一,认为这暴露了产品形态的根本毛病:不该由人一点点从AI身上挖掘能力,而应反过来,由AI主动告诉你,嘿,我现在能用这种新方式帮你。他以文本框作比:ChatGPT和ChatGPT Work说到底都是文本框,新的比旧的好用,但有些事旧的更顺手,所以无法总用新的。他说,这不是他们承诺过的那个AI。

他口中的承诺AI是什么?他给出定义:主要通过语音交流,也可打字;有持久性、记忆、上下文,认识你;值得信任;你见过它主动出手替你解决问题,在生活中和工作里。

Brockman表示,AI发展正进入新阶段,他们称之为AGI时代。究竟是这个模型、上一个模型还是下一个模型跨过了那条线,可以争论,但这不重要。过去10年,人们衡量AI进展主要看跑分。如今,标准开始变了。Astra的跑分已接近天花板:FrontierMath Tier 4达到97.6%,ARC-AGI-3达到99.9%,ExploitBench满分。新的问题不只是“还能变多强”,而是“为了安全,人类愿意让它慢下来多久”。为补齐对齐和监控证据,OpenAI已放慢最新模型训练,甚至暂停了更大规模的前沿训练。

本文来自微信公众号“新智元”,作者:ASI启示录,36氪经授权发布。如需了解更多前沿AI动态,欢迎访问爱游戏官网 IGAME 平台 - 官方游戏入口。

爱游戏官网 IGAME 平台 - 官方游戏入口深耕爱游戏官网 IGAME 平台 - 官方游戏入口领域,用心服务每一位用户。