Navigare
AI BENCHY
Your ad here

AI BENCHY Compare

Mistral: Mistral Small 4 vs OpenAI: gpt-oss-120b

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-11

Metrică Mistral Small 4 Mistral Small 4 medium Lansare: 2026-03-16 gpt-oss-120b gpt-oss-120b none Lansare: 2025-08-05 Disponibil gratuit
Scor 5.7 5.2
Rang #69 #79
Consistență 6.8 7.9
Teste corecte
Rată de trecere pe încercare 50.0% 38.9%
Teste instabile 7 5
Rulări totale 54 54
Cost per rezultat 0.674 0.221
Cost total $0.034 $0.009
Preț de intrare $0.150 / 1M $0.039 / 1M
Preț de ieșire $0.600 / 1M $0.190 / 1M
Tokenuri de ieșire 15,084 44,652
Tokenuri de raționament 39,408 0
Timp de răspuns (mediu) 5.64s 11.96s
Timp de răspuns (maxim) 30.49s 68.97s
Timp de răspuns (total) 101.52s 179.34s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
gpt-oss-120b 6.6 8.0 58.3% 1 6.03s 4,867 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 6.7 3.5 66.7% 1 30.49s 2,796 11,296
gpt-oss-120b 4.3 1.1 66.7% 1 9.57s 3,232 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
gpt-oss-120b 3.0 10.0 0.0% 0 0ms 0 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
gpt-oss-120b 6.5 10.0 50.0% 0 7.12s 598 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
gpt-oss-120b 3.0 10.0 0.0% 0 34.98s 29,483 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
gpt-oss-120b 4.6 10.0 0.0% 0 2.83s 586 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
gpt-oss-120b 8.4 6.9 83.3% 1 5.10s 1,982 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
gpt-oss-120b 4.5 4.8 44.5% 2 6.86s 3,904 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
gpt-oss-120b 3.0 10.0 0.0% 0 0ms 0 0

Comparație rapidă

Schimbă perechea de comparație