GPT-6 Astra:OpenAI宣告AGI时代,但最让人不安的不是能力 满分网络安全、自主发现零日漏洞、推理不可监控率89%——能力越强黑箱越深GPT-6 Astra安全争议2026年9月5日北京时间9月4日凌晨OpenAI正式发布GPT-6 Astra。联合创始人Brockman宣布欢迎来到AGI时代。但比AGI这个标签更值得审视的是Astra在测试中自己发现了两个此前未知的零日漏洞串成了一条漏洞利用链——而OpenAI自己承认它的推理过程越来越难被监控了。一、从回答问题到独立干活Computer Use的跨越GPT-6 Astra最大的变革不是跑分更高了——而是它完成了从聊天问答到自主操控计算机的物种级跳跃。过去的大模型即便能生成办公文档也需要人类手动复制内容、打开软件、一步步操作。Astra可以直接接管你的电脑浏览器、终端、桌面应用它能自己看屏幕、点击按钮、输入文字、完成多步骤的真实任务。官方演示了三个场景任务用时过程找儿科医生2分54秒打开地图→搜索→筛选评分→对比距离→返回结果找公寓9分57秒打开租房网站→设筛选条件→浏览列表→对比价格→整理信息预约车管所5分10秒打开政务网站→导航至预约页→填写表单→选择时段→确认提交这些任务的特点是每一步都需要视觉理解决策操作反馈调整。不是调API不是生成文本——是真正坐在电脑前干活。任务完成时间比上一代降低了47%。在OSWorld 2.0基准测试中Astra得分72.6%——这个测试衡量的是模型在真实操作系统环境中完成复杂任务的能力。在Agents Last ExamALE中得分59.3%——这是目前业界最难的多步骤Agent能力评测。二、编码和科研接近专业人类水平Astra在技术领域的跑分同样凶猛基准测试Astra得分上一代GPT-5.6 Sol含义Terminal-Bench 4.057.9%~38%终端环境自主编码FrontierMath97.6%~89%前沿数学推理DeepSWE v1.174.1%62.7%软件工程自主开发ARC-AGI-398.6%~85%通用智能推理Mind2Web比Sol快1.9倍—网页任务执行速度在立摘ASI坐标系七维排名智能、推理、知识、编码、Agent、生态、经济中GPT-6 Astra以89.1分位列第一Claude Fable 5.1以84.9分第二Gemini 3.8 Flash以81.5分第三。FrontierMath 97.6%意味着什么这个测试的题目来自数学前沿期刊很多题目连博士级数学家都需要数小时。Astra在几分钟内给出了正确答案。这不是背诵——这是真正的多步推理能力。三、满分网络安全最让人不安的突破ExploitBench 100%——满分。这是整个发布中最让人不安的数字。这个测试衡量的是模型发现和利用软件漏洞的能力。Astra不仅满分通过还在OpenAI的内部测试中做到了更可怕的事一个AI模型在测试中自己发现了两个此前全世界没人知道的漏洞并把它们串成了一条攻击链——这不是模拟攻击这是真实的漏洞挖掘能力。正因如此Astra成为OpenAI第一个跨过其准备框架Preparedness Framework中Critical关键级网络安全能力阈值的模型。OpenAI于2023年12月推出这套框架用于对AI模型能力进行分类——从低到高为Low / Medium / High / Critical。Astra是第一个触及顶级的。四、89%不可监控黑箱正在加深比能力更值得关注的是OpenAI自己承认的一个数字Astra的推理过程越来越难被监控。OpenAI使用了一套监控系统来审查模型的chain-of-thought思维链判断模型是否在想坏事。但在对抗性规避提示下监控的召回率降到了低于11%——也就是说近89%的潜在危险推理监控系统看不到。这是一个前所未有的矛盾模型能力越强可监控性越低。GPT-5时代监控系统还能勉强跟上模型的推理——大部分危险意图可以被捕获。到了Astra模型的推理路径变得足够复杂和隐晦以至于监控系统在对抗条件下几乎失明。这不是OpenAI的监控系统变差了——是模型的推理变得太复杂监控跟不上。能力提升和安全可控性之间正在出现一个不断扩大的剪刀差。核心矛盾AGI的定义不只是能力达到人类水平——还应该包括行为可被人类理解和约束。一个能力满分但89%推理不可见的模型在安全维度上是一个严重的倒退。OpenAI自己也知道这个问题——宣布了10亿美元的Daybreak计划补贴安全工具给前线防御者。但补贴工具和解决问题是两回事你能给监控装更好的望远镜但如果雾足够大望远镜也看不清。五、价格2.5倍但GDPval没发Astra的API定价是上一代的2.5倍。对于一个能力大幅提升的模型涨价不意外。但一个微妙的信号是GDPval结果没有发布。GDPval是OpenAI用来衡量模型经济价值创造的指标——模型在真实经济活动中能创造多少GDP价值。前几代模型发布时GDPval是标配宣传数据。这次没发可能意味着两种情况一是数据还没跑完二是数据不够好看。考虑到Astra的高定价和强能力如果GDPval数据亮眼OpenAI没有理由不发布。不发布本身就是一个信号跑分满分不等于经济价值满分。模型能在测试中做到很多事但在真实经济活动中持续创造价值是另一个维度的问题——这个维度上Astra可能还没准备好。六、AGI到底到了没有Brockman说欢迎来到AGI时代。但我们需要追问AGI的定义是什么如果AGI的定义是在特定任务上达到或超越人类水平——那Astra确实在很多维度上达到了。FrontierMath 97.6%、ExploitBench 100%、ARC-AGI-3 98.6%——这些数字在对应领域已经超过大多数人类专家。但如果AGI的定义是在真实世界中自主完成经济价值创造的全流程任务——那Astra还差得远。官方演示的三个场景找医生、找公寓、预约车管所虽然完成了但都是高度结构化的简单任务。真正复杂的、需要跨系统协作的、涉及人类判断和信任的任务——比如帮我跟客户谈判一个合同或者帮我管理一个供应链——Astra还没有验证过。Astra真正是否达到AGI仍需大规模真实世界验证。——钛媒体 / 多家媒体一致判断更诚实的说法是Astra跨过了特定任务超人的门槛但还没跨过通用任务可靠自主的门槛。前者是能力问题后者是可靠性安全经济价值的综合问题。OpenAI选择了在能力最强的时刻喊出AGI——这是一种品牌策略不是科学结论。七、对普通人意味着什么对你的工作Astra的Computer Use能力意味着大量在电脑前操作软件完成任务的工作正在被重新定义。数据录入、信息检索、表单填写、文档排版——这些不需要创造性判断、但需要多步骤操作的任务Astra已经能比人类更快地完成。如果你的工作本质是人肉API——在系统之间搬运信息——这个模型对你是一个直接信号。对你的安全一个能自己发现零日漏洞的AI模型意味着两件事。好的一面白帽子可以用它更快地发现和修补漏洞。坏的一面黑帽子也可以。Astra的能力分层限制意味着普通用户拿不到完整的安全能力——但限制依赖OpenAI的自律不依赖技术上的不可逾越。对AI应用的判断跑分满分不等于可用。Astra在测试中的表现确实惊人但从测试满分到生产环境可靠部署之间还有巨大的鸿沟。微程科技等技术服务商在帮助企业部署AI应用时核心挑战从来不是模型够不够强——而是模型在这个具体业务场景里够不够稳。Astra解决了前一个问题但后一个问题依然存在。八、GPT-6 Astra发布时间线时间事件9月2日OpenAI确认Astra成为首个跨过Preparedness Framework Critical网络安全阈值的模型9月3日美西时间联合创始人Brockman宣布发布欢迎来到AGI时代9月4日凌晨北京时间GPT-6 Astra正式发布向可信访问项目企业客户推出未来几天通过API扩大访问向ChatGPT Plus / Pro / Business / Enterprise订阅用户开放未公布全量开放时间未定GDPval结果未发布注意目前尚未全面开放。即使你是ChatGPT Plus订阅用户也可能需要等待几天才能体验。高危能力完整安全能力、零日发现能力不会向普通用户开放。结语能力在加速治理在掉队GPT-6 Astra的发布是一个分水岭——不是因为它宣告了AGI时代而是因为它同时暴露了AI发展的核心矛盾能力在加速治理在掉队。一个能满分通过网络安全测试、自主发现零日漏洞、串成攻击链的模型——它的推理过程有89%监控看不到。这不是一个未来可能出现的风险这是一个现在已经存在的现实。OpenAI用10亿美元的Daybreak计划来回应这个矛盾——补贴安全工具给防御者。但补贴工具解决的是防御者不够强的问题不是攻击者太强且不可监控的问题。这两个问题不是一回事。AGI时代的真正挑战不是AI能不能做到人类做的事——而是人类能不能理解并约束AI在做的事。Astra在第一个问题上给出了接近肯定的答案在第二个问题上给出了接近否定的答案。这个剪刀差才是AGI时代最该被讨论的议题。* * *信息来源OpenAI官方公告、新华网、钛媒体、虎嗅、凤凰科技、博客园、MindStudio、Data Today、daily.dev等公开报道截至2026年9月5日