ApX 标志ApX 标志

趋近智

GPT-5.4

参数

-

上下文长度

272K

模态

Multimodal

架构

Dense

许可证

Proprietary

发布日期

5 Mar 2026

训练数据截止日期

-

评估基准

排名

#36

基准分数排名

数据分析

high
LiveBench Data Analysis

0.79

6

0.79

6

专业知识

MMLU Pro

0.87

6

0.94

7

0.78

9

LiveBench 平均分

high
LiveBench Average

0.78

10

LiveBench 平均分

max
LiveBench Average

0.78

10

0.88

12

智能编程

high
LiveBench Agentic

0.54

14

智能编程

max
LiveBench Agentic

0.54

14

通用文本

high
Text Arena

1476

16

通用文本

标准
Text Arena

1466

30

Agent Arena

high
Agent Arena

0.05

19

0.78

24

0.78

24

Web 开发

high
WebDev Arena

1463

40

Web 开发

标准
WebDev Arena

1390

58

排名

排名

#36

编程排名

#63

关于 GPT-5.4

GPT-5.4 是 OpenAI 为专业工作打造的最强大且最高效的前沿模型。它将推理、编程和智能体工作流(agentic workflows)方面的最新进展集成于单一模型之中。该模型具备源自 GPT-5.3-Codex 的行业领先编程能力、原生的顶尖计算机操作能力,以及在大型生态系统中经过改进的工具调用能力。它擅长处理涉及电子表格、演示文稿和文档的专业任务。在基准测试中,它在 GDPval 上达到了 83.0%,OSWorld-Verified 为 75.0%,BrowseComp 为 82.7%,SWE-Bench Pro 为 57.7%,MMMU Pro 为 81.2%。GPT-5.4 支持高达 272K 的上下文长度(实验性支持 1M),并实现了迄今为止 Token 效率最高的推理。

技术规格

专有模型的详细架构规格有限。

关于 GPT-5

OpenAI 最新一代语言模型,具备先进的推理能力,支持高达 400K token 的超长上下文窗口,并针对编程、通用智能及效率推出了专门的变体。GPT-5 系列引入了改进的思考模式,在各项基准测试中表现卓越,并提供从高容量 Pro 模型到高效 Nano 模型等多种针对不同用例优化的版本。该系列具备原生多模态理解能力、增强的数学推理能力,并通 Codex 变体实现了业界领先的编程能力。


其他 GPT-5 模型