AGIdex
AI MODEL

GPT-5.4

CLOSED
RELEASED 2026-03

Previous OpenAI flagship. Strong cost-quality balance for production workloads.

Benchmark coverage · per sub-capability

Each score is anchored to human baseline (100). Source URLs link to the original benchmark, leaderboard, or release note.

04ReasoningCOGNITIVE
Sub-capabilityQualitySourceScore vs. baselineScore
Abstract Reasoningindependentarcprize.org/leaderboard
73%
Logical Reasoningvendor reportedopenai.com/research/gpt-5-4
72%
Multi-step Planningindependentpaperswithcode.com/sota/autonomous-agents-on-gaia
56%