Navigare
Advertise here

Mercury 2.5 vs Qwen3 Coder Next (medium)

Qwen3 Coder Next (medium) conduce la scorul mediu cu 4.6 vs 3.9. Mercury 2.5 are costul de benchmark mai mic, $0.016 vs $0.034. Mercury 2.5 este mai rapid cu 2.45s vs 9.07s, cu rate de reușită de 25.8% vs 25.8%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-09-08

Modele comparate

Rang
#312
Total tokenuri de ieșire
71,143
Timp de răspuns (mediu)
2.45s
Cost total
$0.016
Rang
#294
Total tokenuri de ieșire
19,069
Timp de răspuns (mediu)
9.07s
Cost total
$0.034
Model recomandat Qwen3 Coder Next (medium)

Are cel mai puternic scor din această comparație (4.6) și cel mai bun echilibru între cost și timp de răspuns dintre toate cele 2 modele.

Comparație detaliată

Metrică Mercury 2.5 Mercury 2.5 none Lansare: 2026-09-08 Qwen3 Coder Next Qwen3 Coder Next medium Lansare: 2026-02-03
Scor 3.9 4.6
Rang #312 #294
Fiabilitate 10.0 10.0
Consistență 7.5 8.6
Încercări 66/66 66/66
Teste corecte
Rată de trecere pe încercare 25.8% 25.8%
Teste instabile 7 4
Rulări totale 66 66
Cost per rezultat 0.782 1.058
Cost total $0.016 $0.034
Preț de intrare $0.040 / 1M $0.120 / 1M
Preț de ieșire $0.150 / 1M $0.800 / 1M
Total tokenuri de intrare 123,740 148,203
Tokenuri de ieșire 71,143 19,069
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 2.45s 9.07s
Timp de răspuns (maxim) 36.48s 81.80s
Timp de răspuns (total) 53.83s 154.19s
Parametri ~100B 80B în total (3B activi)
Disponibilitate Închis Sursă deschisă

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#312 Mercury 2.5

none
Cost
$0.001
Timp
2.7s
Tokenuri
2,749 tok

#294 Qwen3 Coder Next

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Cost
$0.000
Timp
300.0s
Tokenuri
0 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Mercury 2.5 3.7 7.0 22.2% 1 12.50s 7,888 61,297 0
Qwen3 Coder Next 3.7 7.2 22.2% 1 924ms 7,185 336 0

Comparație rapidă

Schimbă perechea de comparație