- Nafasi
- #64
- Jumla ya tokeni za matokeo
- 71,252
- Muda wa majibu (wastani)
- 28.51s
- Jumla ya gharama
- $1.182
GPT-5.2 (medium) vs Grok 4.5 (medium)
Grok 4.5 (medium) inaongoza kwa average score: 8.5 vs 8.4. GPT-5.2 (medium) ina gharama ya chini ya benchmark: $1.182 vs $2.042. GPT-5.2 (medium) ni ya haraka zaidi: 28.51s vs 68.59s, na pass rates 72.7% vs 83.3%.
Modeli zilizolinganishwa
- Nafasi
- #60
- Jumla ya tokeni za matokeo
- 299,460
- Muda wa majibu (wastani)
- 68.59s
- Jumla ya gharama
- $2.042
Muundo unaopendekezwa
GPT-5.2 (medium)
Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than Grok 4.5 (medium).
Ulinganisho wa kina
| Kipimo | GPT-5.2 GPT-5.2 medium | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| Alama | 8.4 | 8.5 |
| Nafasi | #64 | #60 |
| Uaminifu | 10.0 | 10.0 |
| Uthabiti | 8.5 | 8.9 |
| Majaribio | 66/66 | 66/66 |
| Majaribio sahihi | ||
| Kiwango cha kupita kwa kila jaribio | 72.7% | 83.3% |
| Majaribio yasiyo thabiti | 4 | 3 |
| Jumla ya uendeshaji | 66 | 66 |
| Gharama kwa matokeo | 8.438 | 12.007 |
| Jumla ya gharama | $1.182 | $2.042 |
| Bei ya ingizo | $1.750 / 1M | $2.000 / 1M |
| Bei ya toleo | $14.000 / 1M | $6.000 / 1M |
| Jumla ya tokeni za ingizo | 105,013 | 122,155 |
| Tokeni za matokeo | 9,914 | 5,514 |
| Tokeni za hoja | 61,338 | 293,946 |
| Muda wa majibu (wastani) | 28.51s | 68.59s |
| Muda wa majibu (upeo) | 116.86s | 436.38s |
| Muda wa majibu (jumla) | 456.13s | 1508.91s |
| Vigezo | ~1.2T jumla (~80B vinavyotumika) | ~1.7T jumla (~170B vinavyotumika) |
| Upatikanaji | Imefungwa | Imefungwa |
Onyesho la kizazi cha modeli
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#64 GPT-5.2
medium- Gharama
- $0.047
- Muda
- 49.2s
- Tokeni
- 3,396 tok
#60 SpaceXAI: Grok 4.5
medium- Gharama
- $0.044
- Muda
- 59.4s
- Tokeni
- 7,512 tok
Modeli bora kwa alama
Alama dhidi ya gharama ya jumla
Muda wa majibu (wastani)
Alama vs Muda wa majibu (wastani)
Jumla ya tokeni za matokeo
Alama vs Jumla ya tokeni za matokeo
Mgawanyo wa kategoria
Ulinganisho wa haraka
Badilisha jozi ya ulinganisho
GPT-5.2mediumvsQwen3.8 27BhighGPT-5.2mediumvsGrok 4.5lowDeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumGPT-5.2mediumvsInkling SmallhighGPT-5.2mediumvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.2mediumQwen3.8 27BhighvsGrok 4.5mediumDeepSeek V4.1 FlashhighvsGPT-5.2mediumDeepSeek V4.1 FlashlowvsGPT-5.2medium