Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

North Mini Code vs Mistral: Mistral Small 4

Rezumat

Comparație benchmark North Mini Code vs Mistral Small 4: North Mini Code conduce la scorul mediu cu 5.8 vs 5.1. North Mini Code are costul de benchmark mai mic, $0.000 vs $0.007. Mistral Small 4 este mai rapid cu 630ms vs 106.18s, cu rate de reușită de 50.8% vs 27.0%.

Model recomandat: Mistral Small 4 - Scorul rămâne aproape de cel mai bun scor de aici (5.1 vs 5.8) și răspunde de aproximativ 168.6x mai rapid decât North Mini Code.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-07-02

Metrică North Mini Code North Mini Code medium Lansare: 2026-06-18 Disponibil gratuit Mistral Small 4 Mistral Small 4 none Lansare: 2026-03-16
Scor 5.8 5.1
Rang #110 #134
Fiabilitate 8.5 10.0
Consistență 8.5 9.5
Teste corecte
Rată de trecere pe încercare 50.8% 27.0%
Teste instabile 4 1
Rulări totale 55 63
Cost per rezultat 0.000 0.139
Cost total $0.000 $0.007
Preț de intrare $0.000 / 1M $0.150 / 1M
Preț de ieșire $0.000 / 1M $0.600 / 1M
Total tokenuri de intrare 32,891 37,309
Tokenuri de ieșire 424,772 2,201
Tokenuri de raționament 1,021,489 0
Timp de răspuns (mediu) 106.18s 630ms
Timp de răspuns (maxim) 357.05s 1.72s
Timp de răspuns (total) 2229.70s 13.22s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#110 North Mini Code

medium
Cost
$0.000
Timp
51.8s
Tokenuri
12,460 tok

#134 Mistral Small 4

none
Cost
$0.002
Timp
10.4s
Tokenuri
2,370 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 8.4 10.0 75.0% 0 64.79s 324 64,441 68,535
Mistral Small 4 3.4 7.9 16.7% 1 395ms 708 182 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 4.5 4.9 33.3% 2 320.43s 7,119 219,891 561,569
Mistral Small 4 3.7 9.7 0.0% 0 901ms 7,636 619 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 2.8 1.6 33.3% 1 323.07s 14,760 0 151,500
Mistral Small 4 3.0 10.0 0.0% 0 1.72s 11,640 496 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 10.0 10.0 100.0% 0 24.06s 6,819 240 2,659
Mistral Small 4 10.0 10.0 100.0% 0 822ms 7,914 261 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 5.3 7.2 44.4% 1 71.37s 621 8,483 104,079
Mistral Small 4 5.3 10.0 33.3% 0 367ms 798 28 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 5.1 10.0 0.0% 0 25.08s 444 1,546 1,635
Mistral Small 4 4.0 10.0 0.0% 0 729ms 519 205 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 9.8 10.0 100.0% 0 15.43s 379 909 1,339
Mistral Small 4 6.5 10.0 50.0% 0 380ms 729 69 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 3.3 10.0 0.0% 0 19.70s 543 2,215 2,485
Mistral Small 4 3.1 9.9 0.0% 0 399ms 735 111 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 10.0 10.0 100.0% 0 3.93s 1,776 41 563
Mistral Small 4 10.0 10.0 100.0% 0 1.40s 6,420 213 0
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
North Mini Code 3.0 10.0 0.0% 0 305.02s 106 127,006 127,125
Mistral Small 4 3.0 10.0 0.0% 0 397ms 210 17 0

Comparație rapidă

Schimbă perechea de comparație