Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5-122B-A10B vs Qwen: Qwen3.5-9B

Rezumat

Comparație benchmark Qwen3.5-122B-A10B vs Qwen3.5-9B: Qwen3.5-122B-A10B conduce la scorul mediu cu 5.3 vs 4.2. Qwen3.5-122B-A10B are costul de benchmark mai mic, $0.020 vs $0.036. Qwen3.5-122B-A10B este mai rapid cu 3.41s vs 82.24s, cu rate de reușită de 31.8% vs 27.0%.

Model recomandat: Qwen3.5-122B-A10B - Are cel mai bun scor aici (5.3) și costă de aproximativ 1.8x mai puțin decât Qwen3.5-9B.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-10

Metrică Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lansare: 2026-02-24 Qwen3.5-9B Qwen3.5-9B medium Lansare: 2026-03-02
Scor 5.3 4.2
Rang #132 #162
Fiabilitate 10.0 6.7
Consistență 9.6 8.0
Teste corecte
Rată de trecere pe încercare 31.8% 27.0%
Teste instabile 1 5
Rulări totale 63 63
Cost per rezultat 0.393 1.187
Cost total $0.020 $0.036
Preț de intrare $0.260 / 1M $0.100 / 1M
Preț de ieșire $2.080 / 1M $0.150 / 1M
Total tokenuri de intrare 47,735 17,070
Tokenuri de ieșire 3,383 29,045
Tokenuri de raționament 0 209,516
Timp de răspuns (mediu) 3.41s 82.24s
Timp de răspuns (maxim) 46.00s 226.38s
Timp de răspuns (total) 71.59s 1315.88s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 Qwen3.5-122B-A10B

none
Cost
$0.016
Time
44.5s
Tokens
6,431 tok

#162 Qwen3.5-9B

medium
Cost
$0.001
Time
35.9s
Tokens
3,030 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 696 312 0
Qwen3.5-9B 5.1 5.8 50.0% 2 34.44s 369 2,621 12,411
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 20,175 1,137 0
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 7,794 243 0
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 4,722 1,383 32,113
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 789 15 0
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 295 11,549 48,475
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 522 66 0
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 180 0 30,695
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 6.3 10.0 50.0% 0 513ms 711 69 0
Qwen3.5-9B 6.5 10.0 50.0% 0 5.75s 381 491 1,824
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 3.8 10.0 0.0% 0 1.00s 714 575 0
Qwen3.5-9B 3.0 10.0 0.0% 0 32.27s 376 1,593 12,026
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 8,211 264 0
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 8,283 444 1,149
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 295ms 210 9 0
Qwen3.5-9B 3.0 10.0 0.0% 0 177.02s 68 3,074 29,694

Comparație rapidă

Schimbă perechea de comparație