OpenAI 发布 GPT-6 Astra
OpenAI正式发布最新旗舰模型
GPT-6 Astra,官方称其在计算机使用、编程、网络安全和科学等领域达到业界最先进水平。Astra将在未来几天向ChatGPT Plus、Pro、Business和Enterprise订阅用户开放,并上线API。API定价为每百万输入token10美元、输出50美元。
OpenAI 正式发布 GPT-6 Astra,并称其为迄今最智能、对齐程度最高的模型,能力覆盖计算机操作、网页浏览、软件工程、科研、网络安全和专业工作。
Astra 已开始向少量机构开放,未来几天将陆续提供给 ChatGPT Plus、Pro、Business 和 Enterprise 用户,并通过 OpenAI API 与 AWS 提供。
官方公布其 FrontierMath Tier 4 得分约 98%、ARC-AGI-3 达 99.9%、ExploitBench 达 100%。
Astra 可以直接操作电脑和专业软件,完成填写在线表单、更新 CRM 客户记录、整理日历、在线研究、撰写摘要、分析科学数据、生成图表、创建网站、运行前端测试以及安装和测试软件等任务。
OSWorld 2.0 延迟模拟中,Astra 得分 72.6%,每项任务约耗时 40 分钟,GPT-5.6 Sol 得分 65.7%、约耗时 75 分钟;配合更新后的 Codex,在 Mind2Web 上的任务完成速度达到 Sol 的 1.9 倍。
Astra 也针对文档、电子表格和演示文稿进行了专业训练,可沿用现有模板、布局和写作风格,并尽量只提取与当前工作相关的信息。
在 Codex 中,Astra 还可以跨上下文窗口保存笔记并搜索此前的消息和工具结果,减少长时间编程任务经过多次上下文压缩后丢失细节的问题;这一功能目前为实验性功能,计划在未来几周成为默认设置。
Astra 是 OpenAI 首个达到 Preparedness Framework 网络安全“Critical”能力阈值的模型。
无生产安全措施的测试中,它在 ExploitBench 上取得 100%,GPT-5.6 Sol 为 78.5%;OpenAI 针对 2026年6月至8月 新漏洞建立的内部评测中,Astra 还发现并利用了两个此前未知的零日漏洞。
专家评估显示,无生产防护的 Astra 可以利用未知漏洞在加固浏览器中实现任意代码执行,并针对加固操作系统形成提权利用。
正式版本因此会拒绝更高级的漏洞利用 PoC 等请求,目前主要支持安全代码审查和补丁等防御任务,更高级的防御能力计划通过 Daybreak 逐步开放。
在对齐评测中,GPT-5.6 Sol 在没有生产安全措施的情况下有 48% 的情况超出授权目标,Astra 为 0%;Astra 在内部测试中也没有尝试绕过 Codex Auto-review 的拒绝。
OpenAI 同时披露,在专门要求模型规避监控的测试中,Astra 的书面推理比 GPT-5.6 Sol 更难监控,并表示将继续研究模型推理的可监控性。
开发者可通过 gpt-6-astra 调用模型,OpenAI API 标准价格为每百万输入 token 10 美元、输出 token 50 美元,Fast 模式最高可达到标准处理约 2 倍的速度,价格也为标准模式的 2 倍。


相关链接:
























