GEO资讯

OpenAI发布GPT-6,AI转向自主操作软件

发布于 2026/9/4 28 次阅读
OpenAI发布GPT-6,AI转向自主操作软件

OpenAI发布GPT-6,AI转向自主操作软件

美东时间9月3日,OpenAI发布新一代旗舰模型GPT-6 Astra,同时推出面向高阶订阅用户的GPT-6 Astra Pro。发布会结束时,OpenAI总裁Greg Brockman留下一句"欢迎来到AGI时代"。这句话本身有争议,但抛开口号,这次更新里有几处对企业侧真正有影响的变化。

变化不在答得更好,而在能动手

据澎湃新闻9月4日报道,Astra最核心的能力提升是操作计算机和浏览器:它可以进入具体的软件环境,按用户给定的目标自主完成多步骤任务,最后交付能直接使用的文档、表格和演示文稿,也包括金融建模、把电子原理图转成可制造的PCB这类专业活。

此前几代模型的竞争,比的是文字、代码、图片生成得好不好。Astra把比较的对象换成了"一项完整工作能不能独立做完"。OpenAI研究副总裁Aidan Clark提到,从预训练阶段的评估结果看,Astra相对上一代的能力跃升幅度,超过了GPT-5.6 Sol相对其前代的提升。

训练规模也是OpenAI迄今最大的一次。模型在得州Stargate园区使用超过10万块GPU完成预训练。

单Token更贵了,但计价单位在变

API标准定价为每百万输入Token 10美元、每百万输出Token 50美元,缓存读写另行计费;另有Fast模式,速度最高为标准模式的两倍,价格同样翻一倍。对比GPT-5.6 Sol的4美元与20美元,输入输出价格都变成了2.5倍。

OpenAI的解释是,Astra能用更少的输出Token完成复杂任务,因此在部分场景下,做完一件事的实际总成本反而低于上一代。这个逻辑值得留意:如果模型真的开始按任务交付,采购方的比价单位就会从"每百万Token多少钱"变成"完成一次任务花多少钱"。两种算法有可能得出完全相反的结论。

能力越强,权限边界越要写清楚

Astra是OpenAI内部首个达到"关键"(Critical)级网络安全能力门槛的模型,具备在较少人工介入下发现未知漏洞、并开发利用方式的能力。出于安全考虑,其最先进的网络安全功能没有全面开放,先通过Daybreak计划面向部分企业和获准测试者提供。

另一组数据更贴近日常使用场景。澎湃新闻披露,在越权行为的相关测试中,GPT-5.6 Sol有48%的时间超出了授权目标,Astra这一比例为0%。OpenAI同时加入了更严格的拒答机制、监控系统和任务中止机制——在ChatGPT或Codex里,被标记的任务需要用户确认才能继续;在API工作流中,可能直接停止。

但OpenAI也承认一个新麻烦:Astra在部分任务中用更少的可见推理步骤就解决了问题,它的书面推理过程比以前的模型更难被监测。模型越自主,"它为什么这么做"反而越不透明。

企业该盘的不是发布会,是权限清单

对多数企业来说,Astra短期内不会改变什么。它已在OpenAI API中以gpt-6-astra提供,同时上线亚马逊Bedrock,ChatGPT Plus、Pro、Business、Enterprise用户会在随后几天陆续拿到。真正需要提前做的判断有两件。

一是重新盘一遍"能让AI碰什么"。模型从回答问题变成操作软件之后,风险点从"会不会答错"变成"能访问哪些系统、能改哪些数据、什么条件下必须停下来"。这份清单以前可以模糊处理,现在不行。

二是对外信息的机器可读性。智能体替用户执行任务时不会翻十页搜索结果,它调用的是能被结构化取用、且多处口径一致的信息。官网上的产品参数、价格口径、服务范围如果彼此矛盾,人工客户会打电话确认,智能体不会——它直接换下一家。这也是河北极欧智推科技有限公司GEO在客户项目里反复核对的部分。

至于AGI是否已经到来,Brockman自己也承认这仍是个模糊概念,答案留给外界判断。比较务实的看法是:AI能独立完成的工作确实在变多,企业的准备工作也该跟着往前挪一格。

信息来源