Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

Inception: Mercury 2 vs Nemotron 3 Ultra 550b A55b

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-04

Metriek Mercury 2 Mercury 2 medium Releasedatum: 2026-02-24 Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Releasedatum: 2026-06-04 Gratis beschikbaar
Score 6.6 7.5
Rang #81 #41
Betrouwbaarheid 10.0 9.7
Consistentie 8.8 8.8
Correcte tests
Slaagpercentage per poging 54.0% 69.8%
Instabiele tests 3 3
Totaal runs 63 63
Kosten per resultaat 0.578 0.000
Totale kosten $0.058 $0.000
Invoerprijs $0.250 / 1M $0.000 / 1M
Uitvoerprijs $0.750 / 1M $0.000 / 1M
Totaal aantal invoer-tokens 35,116 46,813
Uitvoer-tokens 4,048 18,002
Redeneer-tokens 61,219 53,091
Responstijd (gem.) 2.24s 15.05s
Responstijd (max) 14.63s 43.93s
Responstijd (totaal) 44.72s 316.09s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 6.9 9.9 50.0% 0 1.12s 554 2,546 2,609
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 10.0 10.0 100.0% 0 3.28s 12,909 268 4,887
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 7.3 5.9 83.3% 1 1.11s 6,234 183 1,656
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 2.9 7.2 11.1% 1 6.48s 695 41 30,754
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 4.8 10.0 0.0% 0 821ms 456 137 542
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 10.0 10.0 100.0% 0 1.07s 340 14 958
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 5.4 10.0 33.3% 0 949ms 601 361 2,781
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 10.0 10.0 100.0% 0 1.89s 6,080 180 1,956
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Mercury 2 3.0 10.0 0.0% 0 2.58s 182 22 3,748
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240

Snelle vergelijking

Vergelijkingspaar wisselen