AI BENCHY Compare

Google: Gemma 4 26B A4B vs Qwen: Qwen3.6 27B

Summary

Gemma 4 26B A4B vs Qwen3.6 27B benchmark comparison: Qwen3.6 27B leads on average score with 6.6 vs 5.5. Gemma 4 26B A4B has the lower benchmark cost at $0.004 vs $0.336. Gemma 4 26B A4B is faster at 5.91s vs 59.71s, with pass rates of 44.4% vs 60.3%.

Recommended model: Gemma 4 26B A4B - It offers the best overall trade-off: a competitive score (5.5), lower cost than Qwen3.6 27B, and balanced response time.

Last updated at: 2026-07-02

Metric	Gemma 4 26B A4B Gemma 4 26B A4B none Release: 2026-04-03 Free Available	Qwen3.6 27B Qwen3.6 27B medium Release: 2026-04-20

Metric	Gemma 4 26B A4B Gemma 4 26B A4B none Release: 2026-04-03 Free Available	Qwen3.6 27B Qwen3.6 27B medium Release: 2026-04-20
Score	5.5	6.6
Rank	#125	#84
Reliability	10.0	10.0
Consistency	9.2	8.2
Tests Correct
Attempt pass rate	44.4%	60.3%
Flaky tests	2	5
Total Runs	63	63
Cost per result	0.068	3.361
Total Cost	$0.004	$0.336
Input Price	$0.060 / 1M	$0.286 / 1M
Output Price	$0.330 / 1M	$2.400 / 1M
Total Input Tokens	40,038	39,376
Output Tokens	1,824	16,189
Reasoning Tokens	0	122,521
Response Time (avg)	5.91s	59.71s
Response Time (max)	57.10s	168.22s
Response Time (total)	124.05s	1254.01s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Gemma 4 26B A4B

none

Cost: $0.001
Time: 39.5s
Tokens: 790 tok

#84 Qwen3.6 27B

medium

Cost: $0.009
Time: 39.6s
Tokens: 3,090 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Anti-AI Tricks	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	8.3	10.0	75.0%	0		1.28s	852	230	0
Qwen3.6 27B	8.3	10.0	75.0%	0		12.62s	453	582	4,311

Coding	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	3.7	7.2	22.2%	1		4.16s	7,736	476	0
Qwen3.6 27B	7.7	10.0	66.7%	0		142.99s	5,051	7,968	43,367

Combined	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	3.0	10.0	0.0%	0		30.53s	13,650	309	0
Qwen3.6 27B	7.0	3.7	66.7%	1		83.07s	15,104	2,088	14,689

Data parsing and extraction	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	10.0	10.0	100.0%	0		1.70s	8,352	285	0
Qwen3.6 27B	3.5	1.4	50.0%	2		37.30s	7,778	568	9,404

Domain specific	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	3.6	7.2	22.2%	1		2.49s	903	27	0
Qwen3.6 27B	2.9	7.2	11.1%	1		73.38s	662	3,510	20,352

General Intelligence	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	4.0	10.0	0.0%	0		3.54s	576	85	0
Qwen3.6 27B	6.5	3.4	66.7%	1		39.53s	516	81	3,045

Instructions following	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	6.3	10.0	50.0%	0		690ms	795	75	0
Qwen3.6 27B	10.0	10.0	100.0%	0		37.96s	699	346	6,548

Puzzle Solving	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	6.2	10.0	33.3%	0		744ms	828	114	0
Qwen3.6 27B	7.7	10.0	66.7%	0		61.14s	696	255	12,044

Tool Calling	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	10.0	10.0	100.0%	0		57.10s	6,123	210	0
Qwen3.6 27B	10.0	10.0	100.0%	0		16.88s	8,213	390	2,954

Trivia	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Gemma 4 26B A4B	3.0	10.0	0.0%	0		778ms	223	13	0
Qwen3.6 27B	3.0	10.0	0.0%	0		80.99s	204	401	5,807

Quick Compare

Switch Comparison Pair

Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 27Bmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.6 27Bmedium Gemini 3.1 Flash LitelowvsQwen3.6 27Bmedium Gemini 3.5 FlashminimalvsQwen3.6 27Bmedium Gemma 4 26B A4BnoneFree AvailablevsMiniMax M2.7medium GPT-5.5nonevsQwen3.6 27Bmedium Gemini 3 Flash PreviewnonevsQwen3.6 27Bmedium North Mini CodemediumFree AvailablevsGemma 4 26B A4BnoneFree Available Gemma 4 26B A4BnoneFree AvailablevsMistral Small 4medium Seed-2.0-LitenonevsQwen3.6 27Bmedium Gemini 3.5 FlashnonevsQwen3.6 27Bmedium Gemini 2.5 FlashnonevsQwen3.6 27Bmedium