Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs Qwen: Qwen3.5-122B-A10B

Samenvatting

Qwen3.5-122B-A10B (medium) leidt in gemiddelde score met 7.7 vs 7.0. Qwen3.5-122B-A10B (medium) heeft lagere benchmarkkosten met $0.588 vs $1.079. Gemini 3.5 Flash is sneller met 9.93s vs 42.49s, met slagingspercentages van 77.8% vs 73.0%.

Aanbevolen modelQwen3.5-122B-A10B (medium)Het heeft hier de beste score (7.7) en kost ongeveer 1.8x minder dan Gemini 3.5 Flash.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-07-14

Metriek Gemini 3.5 Flash Gemini 3.5 Flash none Releasedatum: 2026-05-19 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Releasedatum: 2026-02-24
Score 7.0 7.7
Rang #83 #46
Betrouwbaarheid 10.0 10.0
Consistentie 8.9 8.8
Correcte tests
Slaagpercentage per poging 77.8% 73.0%
Instabiele tests 3 3
Totaal runs 63 63
Kosten per resultaat 7.190 5.235
Totale kosten $1.079 $0.588
Invoerprijs $1.500 / 1M $0.260 / 1M
Uitvoerprijs $9.000 / 1M $2.080 / 1M
Totaal aantal invoer-tokens 13,843 41,832
Uitvoer-tokens 117,518 26,187
Redeneer-tokens 0 251,028
Responstijd (gem.) 9.93s 42.49s
Responstijd (max) 64.36s 168.16s
Responstijd (totaal) 178.68s 892.30s

Generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 Gemini 3.5 Flash

none
Kosten
$0.225
Tijd
125.5s
Tokens
25,004 tok

#46 Qwen3.5-122B-A10B

medium
Kosten
$0.019
Tijd
48.7s
Tokens
6,034 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

Snelle vergelijking

Vergelijkingspaar wisselen