- Nafasi
- #24
- Jumla ya tokeni za matokeo
- 88,670
- Muda wa majibu (wastani)
- 23.10s
- Jumla ya gharama
- $1.533
GPT-5.4 (medium) vs GPT-5.5 (low)
GPT-5.5 (low) inaongoza kwa average score: 9.3 vs 8.5. GPT-5.5 (low) ina gharama ya chini ya benchmark: $1.253 vs $1.533. GPT-5.5 (low) ni ya haraka zaidi: 10.13s vs 23.10s, na pass rates 77.3% vs 86.4%.
- Nafasi
- #9
- Jumla ya tokeni za matokeo
- 28,418
- Muda wa majibu (wastani)
- 10.13s
- Jumla ya gharama
- $1.253
Muundo unaopendekezwa
GPT-5.5 (low)
It has the best score here (9.3), while responding about 2.3x faster than GPT-5.4 (medium).
Ulinganisho wa kina
| Kipimo | GPT-5.4 GPT-5.4 medium | GPT-5.5 GPT-5.5 low |
|---|---|---|
| Alama | 8.5 | 9.3 |
| Nafasi | #24 | #9 |
| Uaminifu | 10.0 | 10.0 |
| Uthabiti | 8.6 | 10.0 |
| Majaribio sahihi | ||
| Kiwango cha kupita kwa kila jaribio | 77.3% | 86.4% |
| Majaribio yasiyo thabiti | 4 | 0 |
| Jumla ya uendeshaji | 66 | 66 |
| Gharama kwa matokeo | 10.220 | 6.594 |
| Jumla ya gharama | $1.533 | $1.253 |
| Bei ya ingizo | $2.500 / 1M | $5.000 / 1M |
| Bei ya toleo | $15.000 / 1M | $30.000 / 1M |
| Jumla ya tokeni za ingizo | 81,127 | 80,058 |
| Tokeni za matokeo | 6,155 | 5,378 |
| Tokeni za hoja | 82,515 | 23,040 |
| Muda wa majibu (wastani) | 23.10s | 10.13s |
| Muda wa majibu (upeo) | 100.41s | 56.19s |
| Muda wa majibu (jumla) | 508.26s | 222.82s |
Onyesho la kizazi cha modeli
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#24 GPT-5.4
medium- Gharama
- $0.214
- Muda
- 199.6s
- Tokeni
- 14,349 tok
#9 GPT-5.5
low- Gharama
- $0.068
- Muda
- 37.0s
- Tokeni
- 2,339 tok
Modeli bora kwa alama
Alama dhidi ya gharama ya jumla
Muda wa majibu (wastani)
Alama vs Muda wa majibu (wastani)
Jumla ya tokeni za matokeo
Alama vs Jumla ya tokeni za matokeo
Mgawanyo wa kategoria
Ulinganisho wa haraka
Badilisha jozi ya ulinganisho
Claude Opus 5lowvsGPT-5.4mediumGemini 3.1 Pro PreviewmediumvsGPT-5.5lowClaude Opus 5highvsGPT-5.5lowGPT-5.4mediumvsGrok 4.5lowClaude Opus 5mediumvsGPT-5.5lowGPT-5.5lowvsQwen3.7 MaxmediumGemini 3.5 FlashmediumvsGPT-5.5lowGemini 3.5 FlashhighvsGPT-5.5lowGemini 3 Flash PreviewmediumvsGPT-5.5lowMuse Spark 1.1lowvsGPT-5.4mediumGemini 3.6 FlashhighvsGPT-5.5lowGPT-5.5lowvsGrok 4.5high