Navigare
AI BENCHY
Your ad here

AI BENCHY Compare

Mistral: Mistral Small 4 vs Qwen: Qwen3.5-9B

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-17

Metrică Mistral Small 4 Mistral Small 4 medium Lansare: 2026-03-16 Qwen3.5-9B Qwen3.5-9B none Lansare: 2026-03-02
Rang #55 #67
Scor 5.6 4.8
Consistență 7.0 10.0
Cost per rezultat 0.502 0.111
Cost total $0.026 $0.005
Teste corecte
Rată de trecere pe încercare 49.0% 23.5%
Teste instabile 6 0
Rulări totale 51 51
Tokenuri de ieșire 12,288 2,945
Tokenuri de raționament 28,112 0
Timp de răspuns (mediu) 4.18s 1.22s
Timp de răspuns (maxim) 25.25s 5.91s
Timp de răspuns (total) 71.03s 20.74s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Qwen3.5-9B 3.1 9.9 0.0% 0 1.71s 582 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Qwen3.5-9B 3.0 10.0 0.0% 0 5.91s 1,255 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Qwen3.5-9B 10.0 10.0 100.0% 0 847ms 249 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Qwen3.5-9B 3.0 10.0 0.0% 0 464ms 24 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Qwen3.5-9B 4.4 9.9 0.0% 0 552ms 99 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Qwen3.5-9B 6.5 10.0 50.0% 0 514ms 75 0
Puzzle Solving Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
Qwen3.5-9B 3.2 9.9 0.0% 0 683ms 388 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
Qwen3.5-9B 10.0 10.0 100.0% 0 1.27s 273 0

Comparație rapidă

Schimbă perechea de comparație