Urambazaji
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Inception: Mercury 2 vs OpenAI: GPT-5.5

Mercury 2 (medium) inaongoza kwa average score: 7.0 vs 6.9. Mercury 2 (medium) ina gharama ya chini ya benchmark: $0.093 vs $0.544. GPT-5.5 ni ya haraka zaidi: 2.36s vs 2.72s, na pass rates 51.5% vs 56.1%.

Muundo unaopendekezwaMercury 2 (medium)It has the best score here (7.0), while costing about 5.9x less than GPT-5.5.

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-07-24

Kipimo Mercury 2 Mercury 2 medium Toleo: 2026-02-24 GPT-5.5 GPT-5.5 none Toleo: 2026-04-24
Alama 7.0 6.9
Nafasi #82 #91
Uaminifu 10.0 10.0
Uthabiti 8.8 8.9
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 51.5% 56.1%
Majaribio yasiyo thabiti 3 3
Jumla ya uendeshaji 66 66
Gharama kwa matokeo 0.928 4.945
Jumla ya gharama $0.093 $0.544
Bei ya ingizo $0.250 / 1M $5.000 / 1M
Bei ya toleo $0.750 / 1M $30.000 / 1M
Jumla ya tokeni za ingizo 109,572 79,285
Tokeni za matokeo 10,313 4,915
Tokeni za hoja 76,806 0
Muda wa majibu (wastani) 2.72s 2.36s
Muda wa majibu (upeo) 14.63s 12.24s
Muda wa majibu (jumla) 57.12s 51.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#82 Mercury 2

medium
Gharama
$0.002
Muda
2.1s
Tokeni
1,702 tok

#91 GPT-5.5

none
Gharama
$0.090
Muda
54.3s
Tokeni
3,063 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho