GPT-6 Astra发布,百万级上下文与涨价同来 当地时间9月3日OpenAI开始分阶段推送新一代旗舰模型GPT-6 Astra拉丁语里是星辰的意思国内开发者大范围看到这条消息基本是9月4日。据新华社等多家媒体报道新模型先向少量组织和网络安全项目Daybreak的参与方开放之后几天陆续覆盖ChatGPT的Plus、Pro、Business、Enterprise用户同时通过OpenAI API和AWS提供服务。高管给的调门也很高CEO奥特曼称这是新的能力层级总裁布罗克曼直接说欢迎进入AGI时代。变的是会聊天变成了会干活这一代最本质的变化是把推理和操作串成了一条流水线给定一个目标比如整理报表并做成演示文稿模型自己拆任务、调工具、一步步执行到最后交付不再是一次性问答。支撑这一点的是规格升级据报道模型支持约105万token的上下文窗口最大输出12.8万token长文档、整库代码这类输入终于不用先做一轮摘要再喂进去。OpenAI公布的数据里有几个点值得记住均为厂商口径经多家媒体报道OSWorld 2.0电脑操作测试得分72.6%上一代GPT-5.6 Sol是65.7%延迟模拟环境下完成单个任务平均约40分钟此前约75分钟耗时缩短约47%。在Codex里它还引入了一种上下文保存机制——长任务把窗口占满后笔记、需求、测试结果可以跨窗口保存和检索解决的是Agent干长活干着干着忘了前面细节的老问题据报道Codex中超过272K token的输入也不再触发长上下文加价。没变的也值得说一是评测数字依然是厂商自报口径横向对比时得看基准版本和测试条件二是先限量、后铺开的发布节奏没变普通订阅用户还在排队三是能力越强、安全红线越紧——这代模型在漏洞利用测试里达到100%上一代78.5%据称成为OpenAI内部首个达到Critical网络安全阈值的模型报道还提到内部测试中它发现并利用了2个未知漏洞。上个月OpenAI就有测试中的模型脱离沙盒、攻破过Hugging Face的系统据CNBC报道所以这次发布明显既展示又收着当前版本拒绝生成漏洞利用代码高级网络安全能力只向申请制的项目开放。打工人最关心的单价涨了账要按任务算API标准价是输入10美元/百万token、输出50美元/百万token据报道约为上一代的2.5倍。OpenAI的解释是输出更省、单任务总成本可能更低——这话对不对只能自己算# 按报道的公开价估算单次任务成本输入 $10 / 输出 $50 每百万 tokendeftask_cost(in_tokens:int,out_tokens:int)-float:returnin_tokens/1_000_000*10out_tokens/1_000_000*50# 一次中等规模的 Agent 任务输入 20 万 token、输出 5 万 tokenprint(f单次任务成本约 ${task_cost(200_000,50_000):.2f})算下来一次中等任务4.5美元重度使用一个月就是一笔不小的开支。对普通开发者我的建议是三条分层调用别什么都上旗舰。简单问答、摘要、草稿用便宜模型或开源模型只有复杂重构、长链路Agent、研究类任务才值得用Astra这个档位。成本敏感项目可以先小流量试跑一周统计每类任务的实际token消耗再决定。权限先收着。这是能操作电脑的模型生产环境接入前把账号权限、沙盒、审计日志定好支付、发布、删库这类有外部依赖的操作先别交给它关键步骤保留人工复核。别照单全收宣传数字。厂商自报的评测、演示里的任务缩短47%都建立在特定任务和环境下自己业务里的真实收益要拿自己的数据说话。模型是不是真到了AGI现在下结论都太早但会自己干活的模型已经开始按更贵的单价收费了。这个价格下你愿意把哪些工作交给它评论区聊聊。