2026 年 5 月 6 日 星期三
  • 登录
  • 注册
周天财经
广告
  • 首页
  • 24 小时
  • 世界
  • 商业
  • 基金
  • 期货
  • 股票
  • 行业新闻
  • 黄金
没有结果
查看所有结果
  • 首页
  • 24 小时
  • 世界
  • 商业
  • 基金
  • 期货
  • 股票
  • 行业新闻
  • 黄金
没有结果
查看所有结果
周天财经
没有结果
查看所有结果
首页 24 小时

GPT-5.2 来了!OpenAI 称其为 「最强专业知识工作大模型」

2025 年 12 月 12 日
在 24 小时
阅读时间: 1 min read
阅读:916
A A

Related articles

巴基斯坦外长说对话与外交仍是唯一可行的途径

2026 年 5 月 6 日
上海4月二手房网签量创近10年同期新高:购房者决策周期明显缩短

上海 4 月二手房网签量创近 10 年同期新高:购房者决策周期明显缩短

2026 年 5 月 6 日

财联社 12 月 12 日讯 (编辑 史正丞)被谷歌逼到拉响 「红色警报」 后,OpenAI 周四终于端出了最新前沿模型 GPT-5.2 系列。

(来源:OpenAI 官网)

OpenAI 介绍称,GPT‑5.2 是迄今为止在 「专业知识工作方面」 表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2 有三种不同的版本:Instant 是针对常规查询 (如互联网检索、翻译和写作) 进行速度优化的模型;Thinking 擅长编程、数学、长文档分析等复杂结构化工作;顶级型号 Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI 特别强调,GPT‑5.2 Thinking 是迄今为止最适合现实世界专业用途的模型。在评估涵盖 44 个职业的知识型工作任务的 GDPval 测试中,有 70.9% 的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

image

另外在金融 AI 领域,GPT‑5.2 Thinking 的产出成果也明显好于 GPT-5.1。

OpenAI 给出的示例显示,GPT‑5.2 Thinking 在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较 GPT‑5.1 Thinking 有肉眼可见的进步。

image
image
image

(来源:OpenAI)

除了做 PPT 和 Excel 表格外,OpenAI 也表示,GPT-5.2 在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来 「更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统」。

横向比较方面,GPT-5.2 Thinking 在几乎所有列出的推理测试中都略胜于 Gemini 3 和 Anthropic 的 Claude Opus 4.5,涵盖现实世界的软件工程任务 (SWE-Bench Pro) 和博士级别的科学知识 (GPQA Diamond),到抽象推理和模式发现 (ARC-AGI 套件)。

image

(来源:OpenAI)

OpenAI 产品负责人 Max Schwarzer 也在周四通报称,GPT-5.2 Thinking 的回复较前代减少了 38% 的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2 将向所有 ChatGPT 付费用户和 API 用户推送。所以这个新模型到底有多么适合 「打工」,很快就能见分晓。

作为 OpenAI 对谷歌的反击,GPT‑5.2 仅仅是打出的 「第一拳」。

公司 CEO 奥尔特曼在周四宣布,下周会给用户们带来一些 「小小的圣诞礼物」。他也在周四表示,Gemini 3 对公司各项指标的影响比原本担心得要小。他还说,预计 OpenAI 将在明年 1 月 「以非常强劲的姿态」 退出目前的红色警报状态。

image

OpenAI 首席产品官 Fidji Simo 也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制 ChatGPT 对 18 岁以下用户回复的内容。Simo 也表示,公司希望在明年一季度推出 「成人模式」 前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的 「红色警报」 备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI 计划在明年 1 月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

广告

相关 文章

巴基斯坦外长说对话与外交仍是唯一可行的途径

来自 新华社
2026 年 5 月 6 日
0

新华财经伊斯兰堡 5 月 4 日电 (记者杨恺) 巴...

上海4月二手房网签量创近10年同期新高:购房者决策周期明显缩短

上海 4 月二手房网签量创近 10 年同期新高:购房者决策周期明显缩短

来自 周天财经
2026 年 5 月 6 日
0

4 月,上海二手房市场保持高位运行状态。 ...

伊朗武装部队称将打击接近或进入霍尔木兹海峡的美军

来自 新华社
2026 年 5 月 6 日
0

新华财经德黑兰 5 月 4 日电 伊朗伊斯兰共和...

「五一」 假期首日高速公路充电量同比增长 55.6%

来自 周天财经
2026 年 5 月 5 日
0

「五一」 假期首日,全国高速公路迎来出行高...

【高端访谈】光格科技董事长姜明武:AI孕育颠覆性潜力 创新垂直应用是关键

【高端访谈】 欧中旅游业有望进一步实现互利共赢发展——访欧洲旅游委员会首席执行官桑坦德

来自 新华社
2026 年 5 月 5 日
0

新华财经布鲁塞尔 5 月 4 日电 (记者康逸)...

加载更多
广告
  • 热门
  • 评论
  • 最新
神马经典投研: 集资讯、策略、研报一站式期货投研工具

神马经典投研: 集资讯、策略、研报一站式期货投研工具

2025 年 11 月 7 日
「我们也深陷残酷价格战」,德资巨头中国区高管警告

「我们也深陷残酷价格战」,德资巨头中国区高管警告

2025 年 8 月 4 日
一周产业基金|上海市人工智能CVC基金发布;湖北百亿人形机器人母基金来了

一周产业基金|上海市人工智能 CVC 基金发布;湖北百亿人形机器人母基金来了

2025 年 8 月 4 日
「硬科技」指数携手上涨,半导体设备ETF易方达(159558)、芯片ETF易方达(516350)等产品助力布局板块龙头

基民懵了!这个火爆的板块年内涨超 37%,主力却借道 ETF 狂抛逾 400 亿元

2025 年 9 月 20 日
Lesson 1: Basics Of Photography With Natural Lighting

The Single Most Important Thing You Need To Know About Success

4
Lesson 1: Basics Of Photography With Natural Lighting

Lesson 1: Basics Of Photography With Natural Lighting

3
Lesson 1: Basics Of Photography With Natural Lighting

5 Ways Animals Will Help You Get More Business

2
Lesson 1: Basics Of Photography With Natural Lighting

New Cryptocurrency That Will Kill Of Bitcoin

2

巴基斯坦外长说对话与外交仍是唯一可行的途径

2026 年 5 月 6 日
刚刚,中国最大国产运动医学设备提供商IPO,市值超140亿

刚刚,中国最大国产运动医学设备提供商 IPO,市值超 140 亿

2026 年 5 月 6 日

18K 金价格多少钱一克 (2026 年 5 月 1 日)

2026 年 5 月 6 日
由豆包付费想到,AI到底会长成一门什么生意

由豆包付费想到,AI 到底会长成一门什么生意

2026 年 5 月 6 日
  • 隐私政策
  • 联系我们
  • 关于周天
  • 登录
  • 注册
投诉建议:+86 13326565461

© 2025 广州小舟天传媒有限公司 by 周天财经 - 粤 ICP 备 2025452169 号-1

没有结果
查看所有结果
  • 首页
  • 24 小时
  • 世界
  • 商业
  • 基金
  • 期货
  • 股票
  • 行业新闻
  • 黄金

© 2025 广州小舟天传媒有限公司 by 周天财经 - 粤 ICP 备 2025452169 号-1

欢迎回来!

在下面登录您的帐户

忘记密码? 注册

创建新帐户!

填写以下表格进行注册

所有项目需要填写。 登录

重置您的密码

请输入您的用户名或电子邮件地址以重置密码。

登录

用户登录

还没有账号?立即注册

用户注册

已有账号?立即登录