GSO-Bench
Software optimisation tasks measured against expert speed-ups.
- Published by
- GSO-Benchdata via Epoch AI Benchmarking Hub
- Category
- Coding
- Index weight
- 0.5
- Models
- 31
- Data as of
- 9 Sept 2026
CC BY 4.0 — Epoch AI, ‘AI Benchmarking Hub’, epoch.ai/benchmarks. Mirrored boards credit their original publishers.
- 1Claude Opus 4.847.1%
- 2Claude Opus 4.744.1%
- 3Claude Opus 4.744.1%
- 4Claude Opus 4.641.2%
- 5GPT-5.540.2%
- 6Claude Sonnet 537.3%
- 7Claude Opus 4.633.3%
- 8GPT-5.431.4%
- 9GPT-5.227.4%
- 10Claude Opus 4.526.5%
- 11GPT-5.425.5%
- 12Gemini 3.1 Pro22.6%
- 13Gemini 3 Pro18.6%
- 14Claude Sonnet 4.514.7%
- 15GPT-5.113.7%
31 of 31
| # | |||||
|---|---|---|---|---|---|
| 1 | 47.1% | – | 64.7 | – | |
| 2 | 44.1% | – | 65.5 | – | |
| 3 | 44.1% | – | 61.3 | – | |
| 4 | 41.2% | – | 61.3 | – | |
| 5 | 40.2% | – | 63.7 | – | |
| 6 | 37.3% | – | 61.2 | – | |
| 7 | 33.3% | – | 63.1 | – | |
| 8 | 31.4% | – | 61.3 | – | |
| 9 | 27.4% | – | 55.5 | – | |
| 10 | 26.5% | – | 58.0 | – | |
| 11 | 25.5% | – | 58.8 | – | |
| 12 | 22.6% | – | 63.9 | – | |
| 13 | 18.6% | – | 61.6 | – | |
| 14 | 14.7% | – | 52.3 | – | |
| 15 | 13.7% | – | 59.4 | – | |
| 16 | 13.7% | – | 53.8 | – | |
| 17 | 9.8% | – | 56.6 | – | |
| 18 | 8.8% | – | 52.9 | – | |
| 19 | 6.9% | – | 50.7 | – | |
| 20 | 6.9% | – | 54.5 | – | |
| 21 | 4.9% | – | 49.5 | – | |
| 22 | 4.9% | – | 48.8 | – | |
| 23 | 4.9% | – | 48.5 | – | |
| 24 | 4.6% | – | 45.1 | – | |
| 25 | 3.9% | – | 54.1 | – | |
| 26 | 3.8% | – | 49.8 | – | |
| 27 | 3.6% | – | 48.0 | – | |
| 28 | 2.9% | – | 46.0 | – | |
| 29 | 1.3% | – | 47.8 | – | |
| 30 | 1.3% | – | 40.4 | – | |
| 31 | 0.0% | – | 42.3 | – |