Navigatie
Advertise here

Mercury 2.5 (low) vs GPT-4o-mini

Mercury 2.5 (low) leidt in gemiddelde score met 5.1 vs 5.0. GPT-4o-mini heeft lagere benchmarkkosten met $0.010 vs $0.011. Mercury 2.5 (low) is sneller met 1.35s vs 1.92s, met slagingspercentages van 39.4% vs 22.7%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-08

Vergeleken modellen

Rang
#265
Totaal aantal uitvoer-tokens
33,719
Responstijd (gem.)
1.35s
Totale kosten
$0.011
Rang
#274
Totaal aantal uitvoer-tokens
2,913
Responstijd (gem.)
1.92s
Totale kosten
$0.010
Aanbevolen model Mercury 2.5 (low)

Het heeft de sterkste score in deze vergelijking (5.1) en de beste balans tussen kosten en responstijd over alle 2 modellen.

Gedetailleerde vergelijking

Metriek Mercury 2.5 Mercury 2.5 low Releasedatum: 2026-09-08 GPT-4o-mini GPT-4o-mini none Releasedatum: 2024-07-18
Score 5.1 5.0
Rang #265 #274
Betrouwbaarheid 9.8 10.0
Consistentie 8.1 9.9
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 39.4% 22.7%
Instabiele tests 5 0
Totaal runs 66 66
Kosten per resultaat 0.177 0.195
Totale kosten $0.011 $0.010
Invoerprijs $0.040 / 1M $0.150 / 1M
Uitvoerprijs $0.150 / 1M $0.600 / 1M
Totaal aantal invoer-tokens 138,020 53,145
Uitvoer-tokens 6,083 2,913
Redeneer-tokens 27,636 0
Responstijd (gem.) 1.35s 1.92s
Responstijd (max) 7.48s 7.58s
Responstijd (totaal) 29.74s 30.71s
Parameters ~100B ~8B
Beschikbaarheid Gesloten broncode Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#265 Mercury 2.5

low
Kosten
$0.001
Tijd
2.4s
Tokens
1,236 tok

#274 GPT-4o-mini

none
Kosten
$0.001
Tijd
6.6s
Tokens
742 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2.5 5.5 10.0 33.3% 0 972ms 7,909 521 2,269
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

Snelle vergelijking

Vergelijkingspaar wisselen