Solve novel pattern problems by extracting a rule from a few examples.
Solve unseen ARC-AGI tasks efficiently without task-specific training.
Frontier models reach 85% on ARC-AGI-2 at high compute cost.
ARC-AGI-3 reset frontier models to near-zero — efficient novel generalization unsolved.
| Technology | Quality | Source | Score vs. baseline | Score |
|---|---|---|---|---|
| Claude Opus 4.7 | independent | arcprize.org/leaderboard | 69% | |
| GPT-5.5 | independent | arcprize.org/leaderboard | 85% | |
| GPT-5.4 | independent | arcprize.org/leaderboard | 73% | |
| Gemini 3.1 Pro | independent | arcprize.org/leaderboard | 77% |