Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemma 4 31B vs Qwen: Qwen3.5-35B-A3B

Rezumat

Comparație benchmark Gemma 4 31B vs Qwen3.5-35B-A3B: Qwen3.5-35B-A3B conduce la scorul mediu cu 6.3 vs 6.1. Gemma 4 31B are costul de benchmark mai mic, $0.004 vs $0.401. Gemma 4 31B este mai rapid cu 4.05s vs 72.57s, cu rate de reușită de 47.6% vs 69.8%.

Model recomandat: Gemma 4 31B - Scorul rămâne aproape de cel mai bun scor de aici (6.1 vs 6.3) și costă de aproximativ 133.3x mai puțin decât Qwen3.5-35B-A3B.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-07-02

Metrică Gemma 4 31B Gemma 4 31B none Lansare: 2026-04-02 Disponibil gratuit Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Lansare: 2026-02-24
Scor 6.1 6.3
Rang #101 #92
Fiabilitate 10.0 10.0
Consistență 10.0 7.5
Teste corecte
Rată de trecere pe încercare 47.6% 69.8%
Teste instabile 0 6
Rulări totale 63 63
Cost per rezultat 0.034 5.162
Cost total $0.004 $0.401
Preț de intrare $0.120 / 1M $0.140 / 1M
Preț de ieșire $0.350 / 1M $1.000 / 1M
Total tokenuri de intrare 20,911 42,196
Tokenuri de ieșire 1,407 40,630
Tokenuri de raționament 0 353,577
Timp de răspuns (mediu) 4.05s 72.57s
Timp de răspuns (maxim) 26.13s 409.98s
Timp de răspuns (total) 76.87s 1524.04s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 Gemma 4 31B

none
Cost
$0.001
Timp
12.8s
Tokenuri
795 tok

#92 Qwen3.5-35B-A3B

medium
Cost
$0.009
Timp
71.4s
Tokenuri
8,631 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 852 45 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 672 798 42,652
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 20,992 775 12,485
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 8,352 285 0
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 6,061 235 19,493
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 903 27 0
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 500 41 46,368
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 576 117 0
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 172 20 3,753
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 795 78 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 699 97 17,361
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 6.5 10.0 33.3% 0 4.23s 828 108 0
Qwen3.5-35B-A3B 8.2 7.2 88.9% 1 33.13s 597 3,592 26,585
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 8,193 309 1,365
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 224 12 0
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 177.35s 204 10,919 72,053

Comparație rapidă

Schimbă perechea de comparație