- Nafasi
- #136
- Jumla ya tokeni za matokeo
- 87,554
- Muda wa majibu (wastani)
- 2.95s
- Jumla ya gharama
- $0.094
Mercury 2 (medium) vs GPT-5.5
average score iko karibu sawa: 7.0 vs 7.0. Mercury 2 (medium) ina gharama ya chini ya benchmark: $0.094 vs $0.544. GPT-5.5 ni ya haraka zaidi: 2.35s vs 2.95s, na pass rates 53.0% vs 59.1%.
- Nafasi
- #135
- Jumla ya tokeni za matokeo
- 4,915
- Muda wa majibu (wastani)
- 2.35s
- Jumla ya gharama
- $0.544
Muundo unaopendekezwa
Mercury 2 (medium)
It has the best score here (7.0), while costing about 5.8x less than GPT-5.5.
Ulinganisho wa kina
| Kipimo | Mercury 2 Mercury 2 medium | GPT-5.5 GPT-5.5 none |
|---|---|---|
| Alama | 7.0 | 7.0 |
| Nafasi | #136 | #135 |
| Uaminifu | 10.0 | 10.0 |
| Uthabiti | 8.4 | 9.2 |
| Majaribio | 66/66 | 66/66 |
| Majaribio sahihi | ||
| Kiwango cha kupita kwa kila jaribio | 53.0% | 59.1% |
| Majaribio yasiyo thabiti | 4 | 2 |
| Jumla ya uendeshaji | 66 | 66 |
| Gharama kwa matokeo | 0.933 | 4.533 |
| Jumla ya gharama | $0.094 | $0.544 |
| Bei ya ingizo | $0.250 / 1M | $5.000 / 1M |
| Bei ya toleo | $0.750 / 1M | $30.000 / 1M |
| Jumla ya tokeni za ingizo | 110,515 | 79,294 |
| Tokeni za matokeo | 10,325 | 4,915 |
| Tokeni za hoja | 77,229 | 0 |
| Muda wa majibu (wastani) | 2.95s | 2.35s |
| Muda wa majibu (upeo) | 14.63s | 12.24s |
| Muda wa majibu (jumla) | 61.89s | 51.78s |
| Vigezo | ~100B | ~1.5T jumla (~100B vinavyotumika) |
| Upatikanaji | Imefungwa | Imefungwa |
Onyesho la kizazi cha modeli
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#136 Mercury 2
medium- Gharama
- $0.002
- Muda
- 2.1s
- Tokeni
- 1,702 tok
#135 GPT-5.5
none- Gharama
- $0.090
- Muda
- 54.3s
- Tokeni
- 3,063 tok
Modeli bora kwa alama
Alama dhidi ya gharama ya jumla
Muda wa majibu (wastani)
Alama vs Muda wa majibu (wastani)
Jumla ya tokeni za matokeo
Alama vs Jumla ya tokeni za matokeo
Mgawanyo wa kategoria
Ulinganisho wa haraka
Badilisha jozi ya ulinganisho
GPT-5.5nonevsGLM 5.1mediumGPT-5.5nonevsGrok 4.20mediumDeepSeek V3.2mediumvsGPT-5.5noneSeed-2.0-MinimediumvsGPT-5.5noneKimi K2.5mediumvsGPT-5.5noneMercury 2mediumvsGPT-5.6 SolnoneGPT-5.5nonevsGrok 4.3mediumKAT-Coder-Pro V2.5mediumvsGPT-5.5noneClaude Fable 5.1lowvsMercury 2mediumClaude Fable 5.1lowvsGPT-5.5noneGPT-5.5nonevsQwen3.7 FlashmediumSeed-2.0-CodehighvsMercury 2medium