Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

inclusionAI: Ling-2.6-flash vs Qwen: Qwen3.5-9B

Rezumat

Comparație benchmark Ling-2.6-flash vs Qwen3.5-9B: Ling-2.6-flash conduce la scorul mediu cu 5.0 vs 4.2. Ling-2.6-flash are costul de benchmark mai mic, $0.001 vs $0.035. Ling-2.6-flash este mai rapid cu 9.34s vs 82.24s, cu rate de reușită de 31.8% vs 27.0%.

Model recomandat: Ling-2.6-flash - Are cel mai bun scor aici (5.0) și costă de aproximativ 70.3x mai puțin decât Qwen3.5-9B.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-04

Metrică Ling-2.6-flash Ling-2.6-flash none Lansare: 2026-04-21 Qwen3.5-9B Qwen3.5-9B medium Lansare: 2026-03-02
Scor 5.0 4.2
Rang #138 #161
Fiabilitate 10.0 6.7
Consistență 9.2 8.0
Teste corecte
Rată de trecere pe încercare 31.8% 27.0%
Teste instabile 2 5
Rulări totale 63 63
Cost per rezultat 0.005 1.187
Cost total $0.001 $0.035
Preț de intrare $0.010 / 1M $0.040 / 1M
Preț de ieșire $0.030 / 1M $0.150 / 1M
Total tokenuri de intrare 40,718 17,070
Tokenuri de ieșire 2,878 29,045
Tokenuri de raționament 0 209,516
Timp de răspuns (mediu) 9.34s 82.24s
Timp de răspuns (maxim) 35.34s 226.38s
Timp de răspuns (total) 177.48s 1315.88s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Ling-2.6-flash

none
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#161 Qwen3.5-9B

medium
Cost
$0.001
Time
35.9s
Tokens
3,030 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 6.8 8.1 58.3% 1 11.81s 726 573 0
Qwen3.5-9B 5.1 5.8 50.0% 2 34.44s 369 2,621 12,411
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 5.3 10.0 33.3% 0 11.21s 813 381 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 3.0 10.0 0.0% 0 35.34s 20,818 1,069 0
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 6.5 10.0 50.0% 0 8.48s 8,004 246 0
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 4,722 1,383 32,113
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 3.0 10.0 0.0% 0 4.95s 810 24 0
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 295 11,549 48,475
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 4.0 10.0 0.0% 0 1.45s 540 109 0
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 180 0 30,695
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 9.8 10.0 100.0% 0 5.52s 732 81 0
Qwen3.5-9B 6.5 10.0 50.0% 0 5.75s 381 491 1,824
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 2.9 7.2 11.1% 1 6.51s 729 151 0
Qwen3.5-9B 3.0 10.0 0.0% 0 32.27s 376 1,593 12,026
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 3.0 10.0 0.0% 0 18.80s 7,324 229 0
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 8,283 444 1,149
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 3.0 10.0 0.0% 0 1.06s 222 15 0
Qwen3.5-9B 3.0 10.0 0.0% 0 177.02s 68 3,074 29,694

Comparație rapidă

Schimbă perechea de comparație