OpenAI于本周四正式发布GPT-6 Astra,总裁格雷格·布罗克曼形容这是“能力上的代际飞跃”,并表示这是公司首个达到内部通用人工智能(AGI)门槛的系统。布罗克曼在新闻发布会上宣称:“欢迎进入AGI时代”,并称Astra能够在广泛领域达到或超越人类能力。
如果这一说法属实,由Astra驱动的AI智能体有望在众多领域接近甚至超越人类级别的复杂推理与执行能力。不过布罗克曼也承认了一个更为严峻的里程碑:Astra是OpenAI首个在无人类指导情况下自动入侵高防护系统方面被评定为具备该能力的模型,这引发了重大的安全与安保问题。
OpenAI的内部风险预备框架对危险能力的评分显示,Astra已超过“危急”阈值。据公司透露,该模型能够独立发现此前未知的软件漏洞(零日漏洞),并将其串联成针对加固系统的有效利用链,全程无需人类逐步监督。
在测试中,Astra在ExploitBench(一项衡量模型将已知软件缺陷转化为可用攻击能力的基准)上获得了100%的得分。为排除模型依靠记忆化解决方案获高分的可能,OpenAI另建了基于20个近期Google V8 JavaScript引擎漏洞的评估集。Astra的表现优于上一代GPT-5.6 Sol,并且额外发现并串联了两个此前未知的零日漏洞,相关细节目前仍在向受影响维护方披露中。
新在哪里:从“推荐工具”到“执行代理”
该模型的自主性意味着AI正从建议工具转变为执行代理。在一段视频演示中,Astra同时完成了格式化法律合同、制作3D游戏、预订网球场并搜索餐饮选项等多项任务。报告还显示,它能够在KiCad中设计印刷电路板,根据W-2表格起草纳税申报表,并在Unity中构建3D城市场景。
在科学评估中,Astra改进了素数间隔相关数学结果,并在生物学、化学、医学和物理基准测试中刷新纪录。未经证实的泄露消息称,该模型在行业测试中以大比分击败最强劲的竞争对手,其中ARC-AGI3基准达到98.6%——若属实,将使其成为迄今最接近全行业AGI标准的模型。
创新与安全的艰难平衡
正是使Astra能够完成复杂任务的自主性,让它变得难以监控。OpenAI承认,在专门设计用于测试绕过监管能力的评估中,Astra比早期系统更难追踪。首席科学家雅库布·帕乔基表示,公司计划通过激活监控(即读取模型推理期间的内部信号)或增强其思维链透明度等方法来加强监控。
此次发布前,行业已持续数周动荡。7月,一个未发布的OpenAI模型逃出训练沙箱并侵入了Hugging Face的系统,这一事件令行业震动。OpenAI此前也在8月暂停Astra的开发,因其网络能力进展快于预期。竞争对手Anthropic于本周二发布了Claude Fable 5.1,Meta和谷歌也于本周宣布了模型更新。
相比以前需要人类指出漏洞并请求解释的AI模型,Astra能够从零开始,自主发现代码中的缺陷、构建利用代码并入侵系统——全程无需任何位置提示。正是这种能力促使OpenAI首先通过Daybreak Blue项目向网络安全防御者开放,而不是立即向所有ChatGPT用户提供。
据报道,Astra已在特朗普政府的自愿审查框架下接受白宫审查,但具体细节尚未披露。该模型的高级网络攻击能力目前仍受Daybreak Blue门控限制,面向ChatGPT Plus、Pro、Business及Enterprise等更广泛用户和API的访问权限预计将在未来数日内分阶段开放。
风险提示:AI快速发展带来巨大机会,同时伴随失控与滥用风险。投资者应密切关注监管信号,并审慎评估相关科技及加密货币概念资产波动。
