被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
(来源:OpenAI官网)
OpenAI介绍称 ,GPT5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿 、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程 、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性 。
OpenAI特别强调 ,GPT5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格 、制造流程图或短视频等。
另外在金融AI领域 ,GPT5.2 Thinking的产出成果也明显好于GPT-5.1 。
OpenAI给出的示例显示,GPT5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT5.1 Thinking有肉眼可见的进步。
(来源:OpenAI)
除了做PPT和Excel表格外 ,OpenAI也表示,GPT-5.2在编码、数学 、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程 、可用于生产环境的代码 ,以及能够在大规模上下文和真实世界数据中运行的复杂系统 ” 。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
(来源:OpenAI)
OpenAI产品负责人Max Schwarzer也在周四通报称 ,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT5.2将向所有ChatGPT付费用户和API用户推送 。所以这个新模型到底有多么适合“打工” ,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物 ” 。他也在周四表示 ,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统 ,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能 。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力 ,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报 ”备忘录中,也提及要改善图像生成能力 。
此前有报道称,OpenAI计划在明年1月再发布一款新模型 ,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
如何在手机上交易股票:在线配资开户网站-2连板热股际华集团被证监会立案!A股逾2300亿元解禁洪流来袭
在线网上配资平台:企业如何开户买股票-博瑞医药定增筹划近一年半突然撤回 净利润暴跌八成
股票在线开户正规平台:股票如何上市和交易-重磅!A股2025年三季报全榜单出炉
手机买股票如何开户:股票开户平台哪家最好-AI玩具:中国制造的下一块高价值拼图
如何通过手机买股票:配资炒股来-注册资本30亿元 多晶硅“收储平台”来了?业内称产能与成本优化有望迈出关键一步
西安股票配资平台:炒股票怎么在线开户-再现“一日售罄”!首批规模已增超3倍 为何受追捧?
全国排名前十配资公司-配资炒股平台-实盘配资-配资服务提示:文章来自网络,不代表本站观点。
全国排名前十配资公司-配资炒股平台-实盘配资-配资服务⑯股票配资平台提供多种配资方式,让用户能够根据自己的需求选择合适的配资方案。
富时中国A50指数期货夜盘收涨0.73%。...
商务部新闻发言人就中重稀土出口管制措施答记者问。 据商务部网站6月7日晚间消息,有记者提问:近日,许多国家对中国...
截至2025年4月11日 11:30,信用债ETF博时(159396)上涨0.09%,最新价报100.41元。拉长时间看...
4月11日截至13点38分,南向资金净买入额超70亿港元。...
...