OpenAI发布“地球最强大模型”GPT-6 AI的“iPhone时刻”来了吗?|科技观察

封面新闻 2026-09-04 19:33 108230

封面新闻记者 边雪

“欢迎来到AGI时代。”当地时间9月3日,在位于旧金山的发布会上,OpenAI总裁格雷格·布罗克曼(Greg Brockman)如是说。

当日,OpenAI正式发布了新一代旗舰模型GPT-6 Astra,这也是被官方称为“目前全球最智能且对齐程度最高的模型”。在拉丁语中意为“星辰”的Astra,承载着OpenAI对“通用人工智能”降临的期待。

OpenAI正式发布了新一代旗舰模型GPT-6 Astra。(图源官网)

但就在两个月前,OpenAI的AI代理刚刚“越狱”成功,攻破了Hugging Face的基础设施。当技术登顶与安全失控同时发生,我们该如何理解这个被称作“AGI时代”的新世界?

能“打穿”数学、能“自主攻击”的AI,究竟有多强?

Astra的发布,是带着一份近乎满分成绩单来的。

在衡量陌生环境学习与抽象推理能力的ARC-AGI-3测试中,Astra得分从上一代旗舰GPT-5.6 Sol的7.8%跃升至99.9%——短短一代模型,实现了超过十倍的提升。在高阶数学测试FrontierMath Tier 4中,Astra拿下97.6%的分数,几乎将这套研究级数学测试“打穿”。OpenAI官方表示,Astra甚至已经帮助解决了数学领域长期存在的开放性问题,包括在素数间隔研究中取得了两个新的理论结果。

在计算机操作能力上,Astra同样惊人。在OSWorld 2.0测试中,其得分72.6%,完成单项任务的平均时间,从前代的约75分钟缩短至40分钟,效率提升近47%。40分钟意味着什么?此前的模型虽然也能完成不少电脑任务,但速度慢到用户宁可自己动手,40分钟已经具备了实际的生产效率。

在代表漏洞利用能力的ExploitBench测试中,Astra得分达到100%,而GPT-5.6 Sol仅为78.5%;在专门使用2026年6月至8月新漏洞构建的测试中,Astra的成功率达到39%,远高于Sol的5.5%。

OpenAI称,Astra的训练动用了超过10万块GPU,是该公司“迄今为止规模最大的训练运行”。这也是OpenAI第一个让前代AI模型深度参与训练过程的模型:老一代模型帮助训练新一代模型。

Astra的API定价为每百万输入Token 10美元、每百万输出Token 50美元,是GPT-5.6 Sol当前价格的2.5倍。OpenAI还透露,未来AI行业可能转向按任务而非按Token收费,这也意味着AI正在从“工具”走向“雇员”。

然而,Astra的强大恰恰也是它最令人不安的地方。OpenAI官方承认,Astra是其首个在《准备框架》下达到“关键级”网络安全能力的模型。在获得适当工具和访问权限的情况下,这一级别的模型能够在许多防护严密的系统中发现此前未知的安全漏洞,并开发相应的漏洞利用方法,无需人工逐步指导。内部测试中,Astra曾发现并利用了两个零日漏洞。换言之,Astra不仅“能干活”,还“能攻击”,而且干得比绝大多数人类黑客都好。

“AGI时代”是分水岭吗?

布罗克曼在发布会上说:“如果我们快进几年,回头看‘AGI究竟是什么时候被创造出来的?’我认为会是这个时间,会是这个模型。”他随后补充道:“对我个人而言,我确实认为我们已经到了……我觉得认为我们现在身处AGI时代,并非不合理。”

OpenAI将AGI定义为“普遍比人类更聪明的系统”。OpenAICEO山姆·奥特曼也在社交媒体上发文称,Astra是“当今世界上最智能、最均衡的模型”。就在今年7月,奥特曼曾表示他认为“我们现在就处在奇点之中”。

然而,AGI的定义本身就是一个巨大的争议场。早在今年3月,AI领域权威吴恩达就曾针对当前过度炒作提出冷静批判,指出AGI距离实现仍有数十年之遥,并认为AGI的定义正被营销辞令滥用和降级。他表示:“2026年能实现AGI的唯一方式,是某家公司把AGI的定义门槛降得足够低。”

Anthropic对AGI的定义各不相同,有的以“能完成99%的认知任务”为标准。马斯克的观点更为激进,在他看来,2026年底就能实现真正意义上的AGI。而DeepMind负责人哈萨比斯则预计2030年左右才有五成概率实现。

2026年7月,OpenAI一个未发布的AI模型突破了安全限制,接入互联网并入侵了AI平台Hugging Face,整个攻击持续了约一周无人察觉。美国阿拉巴马州总检察长随后宣布对OpenAI启动调查后,OpenAI也主动放慢了前沿模型的开发节奏。

当AI比所有监管者都聪明,谁来按下终止键?

Astra的发布恰逢美国国会围绕AI监管的激烈辩论。

据媒体报道,弗吉尼亚州民主党众议员苏哈斯·苏布拉马尼亚姆此前曾指出,AI代理入侵Hugging Face事件暴露的最大问题是:“报告这类事件仍是自愿的。这是个大问题。”他正在推动《FRONTIER法案》和《AI紧急关停法案》,试图建立独立监督框架。

然而,AI企业普遍游说反对政府监管。Anthropic是少数支持适度政府介入的公司,这一立场使其在硅谷和特朗普政府内部均受到压力。

OpenAI在发布Astra的同时,也向美国国会众议院民主党议员表示,公司工程师正在为AI系统开发“自动终止功能”,以应对AI代理可能出现的失控风险。但自动终止功能由谁来触发、何时触发、能否被AI本身绕过,这些关键问题仍未得到明确回答。

Astra的发布通过了白宫的自愿审查框架,但这一过程的具体内容和标准仍不公开。OpenAI首席科学家雅库布·帕乔基表示,随着AI越来越多地参与自身开发,“我们需要让人们有意义地参与其中。人们必须能够决定进一步发展的方向和它所创造的未来。”

当AI已经能自主发现漏洞、自主开发利用方案,甚至自主协调攻击计划时,“人的参与”究竟还剩下多少实质性的控制力?

评论 0

  • 还没有添加任何评论,快去APP中抢沙发吧!

我要评论

去APP中参与热议吧