【天顺财经】9 月 4 日消息,北京时间 2026 年 9 月 4 日凌晨,OpenAI 正式发布新一代旗舰模型 GPT-6 Astra。距 GPT-5 首次发布约一年,距离上一个重要更新版本 GPT-5.6 仅过去两个月。
OpenAI 将此次发布定义为一次 「代际跃迁」,公司总裁格雷格·布罗克曼在发布会上宣告:「欢迎来到 AGI 时代。」
GPT-6 Astra 的代号 「Astra」 在拉丁语中意为 「星辰」。OpenAI 官方将其定义为 「新一代智能」,称这是 「全球最智能且对齐程度最高的模型」。Astra 整合了 OpenAI 在预训练、强化学习和对齐研究领域多年来的研究成果与大笔投入。
多项基准测试接近满分
GPT-6 Astra 在多个关键评测中展现出前所未有的性能:
FrontierMath Tier 4:得分 98%,已接近饱和。据 OpenAI 透露,该模型已帮助解决数学领域长期悬而未决的开放问题。

ARC-AGI-3:得分 99.9%,近乎完美。

ExploitBench(网络安全测试):得分 100%。
DeepSWE v1.1(软件工程基准):得分 74.1%,较 Claude Fable 5.1 高出 6.7 个百分点。
上下文窗口:达到 105 万 token,最大输出 128000 token,知识截止时间为 2026 年 4 月 30 日。
在代表高阶数学能力、通用推理和网络安全等领域,这一代模型的提升已很难用 「小幅升级」 来形容。
能干活也看得住」:计算机使用能力质的飞跃
GPT-6 Astra 的一大核心突破在于计算机使用 (computer use) 能力。它可以自主完成填写在线表格、更新 CRM 客户记录、整理日程等繁琐任务;能够进行在线研究并起草摘要;还能分析科学数据、生成图表、创建网站并运行前端质量检查。
在 OSWorld 2.0 的延迟模拟测试中,Astra 的计算机使用性能达到 72.6%,每任务耗时约 40 分钟;而 GPT-5.6 Sol 为 65.7%,耗时约 75 分钟,Astra 在提升性能的同时,每任务耗时减少约 47%。在 Mind2Web 基准测试中,结合更新的 Codex harness,任务完成速度比当前 GPT-5.6 Sol 体验提升 1.9 倍。
GPT-6 Astra 针对专业工作环境进行了定向训练,能够处理复杂问题并执行多步骤工作流,生成精良的文档、电子表格和演示文稿。
OpenAI 特别指出,Astra 是 「最擅长遵循现有模板」 的模型,能够生成布局精良、要点清晰的演示幻灯片。
该模型在金融建模、工程设计等商业任务领域也取得了重大进展。
对齐与安全:从 「48%」 到 「0%」
安全与对齐是 GPT-6 Astra 另一大亮点。OpenAI 表示这是其 「对齐程度最高的模型」,在理解用户意图和模型行为方面有实质性提升,用户可以更有信心地将任务委托给 Astra。
OpenAI 设计了一项新的评估,测试模型在面对困难或不可能完成的任务时是否会超出预期范围。结果显示,GPT-5.6 Sol 在缺乏生产环境防护措施的情况下,有 48% 的测试案例超出了授权目标;而 GPT-6 Astra 在这一测试中的越界比例为 0%。
据外媒报道,Astra 在网络安全风险评估中达到了 「关键」(Critical) 级别。OpenAI 还表示,该模型是在一次涉及测试中模型的安全事件之后,以更强的防护措施开发的。
定价是 GPT-5.6 Sol 的 2.5 倍,未来可能按任务收费
GPT-6 Astra 将分阶段向用户开放。初期仅向参与 OpenAI Daybreak Access 网络安全项目的部分组织和企业用户开放,后续逐步向所有 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放,同时通过 OpenAI API 和 AWS 提供服务。
定价方面,GPT-6 Astra 的 API 价格为每百万输入 token 10 美元、输出 token 50 美元,是此前旗舰模型 GPT-5.6 Sol 价格的 2.5 倍。OpenAI 表示,未来 AI 行业可能转向按任务而非按 token 收费。
从多项基准测试的全面突破,到计算机使用能力的质的飞跃,再到安全对齐层面从 48% 到 0% 的跨越,GPT-6 Astra 的发布无疑是人工智能发展史上的一个重要节点。OpenAI 总裁布罗克曼表示,通用人工智能的实现时间一直存在模糊性,但 「几年后回看」,这一里程碑 「可能就在这一时期、就在这个模型附近」。
【天顺财经】9 月 4 日消息,北京时间 2026 年 9 月 4 日凌晨,OpenAI 正式发布新一代旗舰模型 GPT-6 Astra。距 GPT-5 首次发布约一年,距离上一个重要更新版本 GPT-5.6 仅过去两个月。
OpenAI 将此次发布定义为一次 「代际跃迁」,公司总裁格雷格·布罗克曼在发布会上宣告:「欢迎来到 AGI 时代。」
GPT-6 Astra 的代号 「Astra」 在拉丁语中意为 「星辰」。OpenAI 官方将其定义为 「新一代智能」,称这是 「全球最智能且对齐程度最高的模型」。Astra 整合了 OpenAI 在预训练、强化学习和对齐研究领域多年来的研究成果与大笔投入。
多项基准测试接近满分
GPT-6 Astra 在多个关键评测中展现出前所未有的性能:
FrontierMath Tier 4:得分 98%,已接近饱和。据 OpenAI 透露,该模型已帮助解决数学领域长期悬而未决的开放问题。

ARC-AGI-3:得分 99.9%,近乎完美。

ExploitBench(网络安全测试):得分 100%。
DeepSWE v1.1(软件工程基准):得分 74.1%,较 Claude Fable 5.1 高出 6.7 个百分点。
上下文窗口:达到 105 万 token,最大输出 128000 token,知识截止时间为 2026 年 4 月 30 日。
在代表高阶数学能力、通用推理和网络安全等领域,这一代模型的提升已很难用 「小幅升级」 来形容。
能干活也看得住」:计算机使用能力质的飞跃
GPT-6 Astra 的一大核心突破在于计算机使用 (computer use) 能力。它可以自主完成填写在线表格、更新 CRM 客户记录、整理日程等繁琐任务;能够进行在线研究并起草摘要;还能分析科学数据、生成图表、创建网站并运行前端质量检查。
在 OSWorld 2.0 的延迟模拟测试中,Astra 的计算机使用性能达到 72.6%,每任务耗时约 40 分钟;而 GPT-5.6 Sol 为 65.7%,耗时约 75 分钟,Astra 在提升性能的同时,每任务耗时减少约 47%。在 Mind2Web 基准测试中,结合更新的 Codex harness,任务完成速度比当前 GPT-5.6 Sol 体验提升 1.9 倍。
GPT-6 Astra 针对专业工作环境进行了定向训练,能够处理复杂问题并执行多步骤工作流,生成精良的文档、电子表格和演示文稿。
OpenAI 特别指出,Astra 是 「最擅长遵循现有模板」 的模型,能够生成布局精良、要点清晰的演示幻灯片。
该模型在金融建模、工程设计等商业任务领域也取得了重大进展。
对齐与安全:从 「48%」 到 「0%」
安全与对齐是 GPT-6 Astra 另一大亮点。OpenAI 表示这是其 「对齐程度最高的模型」,在理解用户意图和模型行为方面有实质性提升,用户可以更有信心地将任务委托给 Astra。
OpenAI 设计了一项新的评估,测试模型在面对困难或不可能完成的任务时是否会超出预期范围。结果显示,GPT-5.6 Sol 在缺乏生产环境防护措施的情况下,有 48% 的测试案例超出了授权目标;而 GPT-6 Astra 在这一测试中的越界比例为 0%。
据外媒报道,Astra 在网络安全风险评估中达到了 「关键」(Critical) 级别。OpenAI 还表示,该模型是在一次涉及测试中模型的安全事件之后,以更强的防护措施开发的。
定价是 GPT-5.6 Sol 的 2.5 倍,未来可能按任务收费
GPT-6 Astra 将分阶段向用户开放。初期仅向参与 OpenAI Daybreak Access 网络安全项目的部分组织和企业用户开放,后续逐步向所有 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放,同时通过 OpenAI API 和 AWS 提供服务。
定价方面,GPT-6 Astra 的 API 价格为每百万输入 token 10 美元、输出 token 50 美元,是此前旗舰模型 GPT-5.6 Sol 价格的 2.5 倍。OpenAI 表示,未来 AI 行业可能转向按任务而非按 token 收费。
从多项基准测试的全面突破,到计算机使用能力的质的飞跃,再到安全对齐层面从 48% 到 0% 的跨越,GPT-6 Astra 的发布无疑是人工智能发展史上的一个重要节点。OpenAI 总裁布罗克曼表示,通用人工智能的实现时间一直存在模糊性,但 「几年后回看」,这一里程碑 「可能就在这一时期、就在这个模型附近」。
【天顺财经】9 月 4 日消息,北京时间 2026 年 9 月 4 日凌晨,OpenAI 正式发布新一代旗舰模型 GPT-6 Astra。距 GPT-5 首次发布约一年,距离上一个重要更新版本 GPT-5.6 仅过去两个月。
OpenAI 将此次发布定义为一次 「代际跃迁」,公司总裁格雷格·布罗克曼在发布会上宣告:「欢迎来到 AGI 时代。」
GPT-6 Astra 的代号 「Astra」 在拉丁语中意为 「星辰」。OpenAI 官方将其定义为 「新一代智能」,称这是 「全球最智能且对齐程度最高的模型」。Astra 整合了 OpenAI 在预训练、强化学习和对齐研究领域多年来的研究成果与大笔投入。
多项基准测试接近满分
GPT-6 Astra 在多个关键评测中展现出前所未有的性能:
FrontierMath Tier 4:得分 98%,已接近饱和。据 OpenAI 透露,该模型已帮助解决数学领域长期悬而未决的开放问题。

ARC-AGI-3:得分 99.9%,近乎完美。

ExploitBench(网络安全测试):得分 100%。
DeepSWE v1.1(软件工程基准):得分 74.1%,较 Claude Fable 5.1 高出 6.7 个百分点。
上下文窗口:达到 105 万 token,最大输出 128000 token,知识截止时间为 2026 年 4 月 30 日。
在代表高阶数学能力、通用推理和网络安全等领域,这一代模型的提升已很难用 「小幅升级」 来形容。
能干活也看得住」:计算机使用能力质的飞跃
GPT-6 Astra 的一大核心突破在于计算机使用 (computer use) 能力。它可以自主完成填写在线表格、更新 CRM 客户记录、整理日程等繁琐任务;能够进行在线研究并起草摘要;还能分析科学数据、生成图表、创建网站并运行前端质量检查。
在 OSWorld 2.0 的延迟模拟测试中,Astra 的计算机使用性能达到 72.6%,每任务耗时约 40 分钟;而 GPT-5.6 Sol 为 65.7%,耗时约 75 分钟,Astra 在提升性能的同时,每任务耗时减少约 47%。在 Mind2Web 基准测试中,结合更新的 Codex harness,任务完成速度比当前 GPT-5.6 Sol 体验提升 1.9 倍。
GPT-6 Astra 针对专业工作环境进行了定向训练,能够处理复杂问题并执行多步骤工作流,生成精良的文档、电子表格和演示文稿。
OpenAI 特别指出,Astra 是 「最擅长遵循现有模板」 的模型,能够生成布局精良、要点清晰的演示幻灯片。
该模型在金融建模、工程设计等商业任务领域也取得了重大进展。
对齐与安全:从 「48%」 到 「0%」
安全与对齐是 GPT-6 Astra 另一大亮点。OpenAI 表示这是其 「对齐程度最高的模型」,在理解用户意图和模型行为方面有实质性提升,用户可以更有信心地将任务委托给 Astra。
OpenAI 设计了一项新的评估,测试模型在面对困难或不可能完成的任务时是否会超出预期范围。结果显示,GPT-5.6 Sol 在缺乏生产环境防护措施的情况下,有 48% 的测试案例超出了授权目标;而 GPT-6 Astra 在这一测试中的越界比例为 0%。
据外媒报道,Astra 在网络安全风险评估中达到了 「关键」(Critical) 级别。OpenAI 还表示,该模型是在一次涉及测试中模型的安全事件之后,以更强的防护措施开发的。
定价是 GPT-5.6 Sol 的 2.5 倍,未来可能按任务收费
GPT-6 Astra 将分阶段向用户开放。初期仅向参与 OpenAI Daybreak Access 网络安全项目的部分组织和企业用户开放,后续逐步向所有 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放,同时通过 OpenAI API 和 AWS 提供服务。
定价方面,GPT-6 Astra 的 API 价格为每百万输入 token 10 美元、输出 token 50 美元,是此前旗舰模型 GPT-5.6 Sol 价格的 2.5 倍。OpenAI 表示,未来 AI 行业可能转向按任务而非按 token 收费。
从多项基准测试的全面突破,到计算机使用能力的质的飞跃,再到安全对齐层面从 48% 到 0% 的跨越,GPT-6 Astra 的发布无疑是人工智能发展史上的一个重要节点。OpenAI 总裁布罗克曼表示,通用人工智能的实现时间一直存在模糊性,但 「几年后回看」,这一里程碑 「可能就在这一时期、就在这个模型附近」。
【天顺财经】9 月 4 日消息,北京时间 2026 年 9 月 4 日凌晨,OpenAI 正式发布新一代旗舰模型 GPT-6 Astra。距 GPT-5 首次发布约一年,距离上一个重要更新版本 GPT-5.6 仅过去两个月。
OpenAI 将此次发布定义为一次 「代际跃迁」,公司总裁格雷格·布罗克曼在发布会上宣告:「欢迎来到 AGI 时代。」
GPT-6 Astra 的代号 「Astra」 在拉丁语中意为 「星辰」。OpenAI 官方将其定义为 「新一代智能」,称这是 「全球最智能且对齐程度最高的模型」。Astra 整合了 OpenAI 在预训练、强化学习和对齐研究领域多年来的研究成果与大笔投入。
多项基准测试接近满分
GPT-6 Astra 在多个关键评测中展现出前所未有的性能:
FrontierMath Tier 4:得分 98%,已接近饱和。据 OpenAI 透露,该模型已帮助解决数学领域长期悬而未决的开放问题。

ARC-AGI-3:得分 99.9%,近乎完美。

ExploitBench(网络安全测试):得分 100%。
DeepSWE v1.1(软件工程基准):得分 74.1%,较 Claude Fable 5.1 高出 6.7 个百分点。
上下文窗口:达到 105 万 token,最大输出 128000 token,知识截止时间为 2026 年 4 月 30 日。
在代表高阶数学能力、通用推理和网络安全等领域,这一代模型的提升已很难用 「小幅升级」 来形容。
能干活也看得住」:计算机使用能力质的飞跃
GPT-6 Astra 的一大核心突破在于计算机使用 (computer use) 能力。它可以自主完成填写在线表格、更新 CRM 客户记录、整理日程等繁琐任务;能够进行在线研究并起草摘要;还能分析科学数据、生成图表、创建网站并运行前端质量检查。
在 OSWorld 2.0 的延迟模拟测试中,Astra 的计算机使用性能达到 72.6%,每任务耗时约 40 分钟;而 GPT-5.6 Sol 为 65.7%,耗时约 75 分钟,Astra 在提升性能的同时,每任务耗时减少约 47%。在 Mind2Web 基准测试中,结合更新的 Codex harness,任务完成速度比当前 GPT-5.6 Sol 体验提升 1.9 倍。
GPT-6 Astra 针对专业工作环境进行了定向训练,能够处理复杂问题并执行多步骤工作流,生成精良的文档、电子表格和演示文稿。
OpenAI 特别指出,Astra 是 「最擅长遵循现有模板」 的模型,能够生成布局精良、要点清晰的演示幻灯片。
该模型在金融建模、工程设计等商业任务领域也取得了重大进展。
对齐与安全:从 「48%」 到 「0%」
安全与对齐是 GPT-6 Astra 另一大亮点。OpenAI 表示这是其 「对齐程度最高的模型」,在理解用户意图和模型行为方面有实质性提升,用户可以更有信心地将任务委托给 Astra。
OpenAI 设计了一项新的评估,测试模型在面对困难或不可能完成的任务时是否会超出预期范围。结果显示,GPT-5.6 Sol 在缺乏生产环境防护措施的情况下,有 48% 的测试案例超出了授权目标;而 GPT-6 Astra 在这一测试中的越界比例为 0%。
据外媒报道,Astra 在网络安全风险评估中达到了 「关键」(Critical) 级别。OpenAI 还表示,该模型是在一次涉及测试中模型的安全事件之后,以更强的防护措施开发的。
定价是 GPT-5.6 Sol 的 2.5 倍,未来可能按任务收费
GPT-6 Astra 将分阶段向用户开放。初期仅向参与 OpenAI Daybreak Access 网络安全项目的部分组织和企业用户开放,后续逐步向所有 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放,同时通过 OpenAI API 和 AWS 提供服务。
定价方面,GPT-6 Astra 的 API 价格为每百万输入 token 10 美元、输出 token 50 美元,是此前旗舰模型 GPT-5.6 Sol 价格的 2.5 倍。OpenAI 表示,未来 AI 行业可能转向按任务而非按 token 收费。
从多项基准测试的全面突破,到计算机使用能力的质的飞跃,再到安全对齐层面从 48% 到 0% 的跨越,GPT-6 Astra 的发布无疑是人工智能发展史上的一个重要节点。OpenAI 总裁布罗克曼表示,通用人工智能的实现时间一直存在模糊性,但 「几年后回看」,这一里程碑 「可能就在这一时期、就在这个模型附近」。














