OpenAI发布GPT-6,AI转向自主操作软件
美东时间9月3日,OpenAI发布新一代旗舰模型GPT-6 Astra,同时推出面向高阶订阅用户的GPT-6 Astra Pro。发布会结束时,OpenAI总裁Greg Brockman留下一句"欢迎来到AGI时代"。这句话本身有争议,但抛开口号,这次更新里有几处对企业侧真正有影响的变化。
变化不在答得更好,而在能动手
据澎湃新闻9月4日报道,Astra最核心的能力提升是操作计算机和浏览器:它可以进入具体的软件环境,按用户给定的目标自主完成多步骤任务,最后交付能直接使用的文档、表格和演示文稿,也包括金融建模、把电子原理图转成可制造的PCB这类专业活。
此前几代模型的竞争,比的是文字、代码、图片生成得好不好。Astra把比较的对象换成了"一项完整工作能不能独立做完"。OpenAI研究副总裁Aidan Clark提到,从预训练阶段的评估结果看,Astra相对上一代的能力跃升幅度,超过了GPT-5.6 Sol相对其前代的提升。
训练规模也是OpenAI迄今最大的一次。模型在得州Stargate园区使用超过10万块GPU完成预训练。
单Token更贵了,但计价单位在变
API标准定价为每百万输入Token 10美元、每百万输出Token 50美元,缓存读写另行计费;另有Fast模式,速度最高为标准模式的两倍,价格同样翻一倍。对比GPT-5.6 Sol的4美元与20美元,输入输出价格都变成了2.5倍。
OpenAI的解释是,Astra能用更少的输出Token完成复杂任务,因此在部分场景下,做完一件事的实际总成本反而低于上一代。这个逻辑值得留意:如果模型真的开始按任务交付,采购方的比价单位就会从"每百万Token多少钱"变成"完成一次任务花多少钱"。两种算法有可能得出完全相反的结论。
能力越强,权限边界越要写清楚
Astra是OpenAI内部首个达到"关键"(Critical)级网络安全能力门槛的模型,具备在较少人工介入下发现未知漏洞、并开发利用方式的能力。出于安全考虑,其最先进的网络安全功能没有全面开放,先通过Daybreak计划面向部分企业和获准测试者提供。
另一组数据更贴近日常使用场景。澎湃新闻披露,在越权行为的相关测试中,GPT-5.6 Sol有48%的时间超出了授权目标,Astra这一比例为0%。OpenAI同时加入了更严格的拒答机制、监控系统和任务中止机制——在ChatGPT或Codex里,被标记的任务需要用户确认才能继续;在API工作流中,可能直接停止。
但OpenAI也承认一个新麻烦:Astra在部分任务中用更少的可见推理步骤就解决了问题,它的书面推理过程比以前的模型更难被监测。模型越自主,"它为什么这么做"反而越不透明。
企业该盘的不是发布会,是权限清单
对多数企业来说,Astra短期内不会改变什么。它已在OpenAI API中以gpt-6-astra提供,同时上线亚马逊Bedrock,ChatGPT Plus、Pro、Business、Enterprise用户会在随后几天陆续拿到。真正需要提前做的判断有两件。
一是重新盘一遍"能让AI碰什么"。模型从回答问题变成操作软件之后,风险点从"会不会答错"变成"能访问哪些系统、能改哪些数据、什么条件下必须停下来"。这份清单以前可以模糊处理,现在不行。
二是对外信息的机器可读性。智能体替用户执行任务时不会翻十页搜索结果,它调用的是能被结构化取用、且多处口径一致的信息。官网上的产品参数、价格口径、服务范围如果彼此矛盾,人工客户会打电话确认,智能体不会——它直接换下一家。这也是河北极欧智推科技有限公司GEO在客户项目里反复核对的部分。
至于AGI是否已经到来,Brockman自己也承认这仍是个模糊概念,答案留给外界判断。比较务实的看法是:AI能独立完成的工作确实在变多,企业的准备工作也该跟着往前挪一格。
信息来源
- 澎湃新闻《AGI时代来了?GPT-6发布:"能干活"也"看得住",称目前智能水平最高模型》,2026年9月4日:https://www.thepaper.cn/newsDetail_forward_34005953
- 新浪财经转网易科技《"欢迎进入AGI时代"!OpenAI发布GPT-6 Astra,10万GPU训练,网安能力首达"关键"级》,2026年9月4日:https://www.toutiao.com/article/7681388873851453952/
- 腾讯新闻《全球AI日报》,2026年9月4日:https://new.qq.com/rain/a/20260904A029SQ00

