AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Qwen: Qwen3.6 35B A3B

Summary

Nemotron 3 Ultra 550b A55b vs Qwen3.6 35B A3B benchmark comparison: Nemotron 3 Ultra 550b A55b leads on average score with 7.5 vs 7.4. Qwen3.6 35B A3B has the lower benchmark cost at $0.146 vs $0.177. Nemotron 3 Ultra 550b A55b is faster at 15.05s vs 18.08s, with pass rates of 69.8% vs 63.5%.

Recommended model: Qwen3.6 35B A3B - It offers the best overall trade-off: a competitive score (7.4), lower cost than Nemotron 3 Ultra 550b A55b, and balanced response time.

Last updated at: 2026-06-10

Metric	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Release: 2026-06-04 Free Available	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Release: 2026-04-20

Metric	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Release: 2026-06-04 Free Available	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Release: 2026-04-20
Score	7.5	7.4
Rank	#42	#47
Reliability	9.7	10.0
Consistency	8.8	9.6
Tests Correct
Attempt pass rate	69.8%	63.5%
Flaky tests	3	1
Total Runs	63	63
Cost per result	0.000	1.094
Total Cost	$0.177	$0.146
Input Price	$0.500 / 1M	$0.140 / 1M
Output Price	$2.500 / 1M	$1.000 / 1M
Total Input Tokens	46,813	16,385
Output Tokens	18,002	19,632
Reasoning Tokens	53,091	130,219
Response Time (avg)	15.05s	18.08s
Response Time (max)	43.93s	86.11s
Response Time (total)	316.09s	343.61s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Nemotron 3 Ultra 550b A55b

medium

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

#47 Qwen3.6 35B A3B

medium

Invalid SVG

Cost: $0.000
Time: 300.0s
Tokens: 0 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Anti-AI Tricks	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		8.62s	780	835	1,485
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		6.02s	672	1,154	12,385

Coding	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	8.4	7.4	88.9%	1		26.53s	7,686	2,854	17,725
Qwen3.6 35B A3B	7.7	10.0	66.7%	0		50.55s	5,051	7,929	37,223

Combined	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		43.93s	17,574	1,040	3,590
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		0ms	0	0	0

Data parsing and extraction	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		5.68s	7,989	473	1,285
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		12.99s	7,776	2,591	9,968

Domain specific	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	3.5	4.4	33.3%	2		24.90s	858	11,169	16,249
Qwen3.6 35B A3B	5.3	7.2	44.4%	1		22.50s	771	6,193	39,116

General Intelligence	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	3.7	9.5	0.0%	0		2.52s	360	70	235
Qwen3.6 35B A3B	4.4	9.9	0.0%	0		8.66s	516	129	4,569

Instructions following	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		6.35s	765	182	1,243
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		7.50s	699	219	7,404

Puzzle Solving	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	5.5	9.9	33.3%	0		3.54s	792	771	2,055
Qwen3.6 35B A3B	8.0	10.0	66.7%	0		5.95s	696	655	9,228

Tool Calling	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		7.72s	9,781	304	984
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		0ms	0	0	0

Trivia	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Input Tokens	Output Tokens	Reasoning Tokens
Nemotron 3 Ultra 550b A55b	3.0	10.0	0.0%	0		38.47s	228	304	8,240
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		32.90s	204	762	10,326

Quick Compare

Switch Comparison Pair

Gemini 3 Flash PreviewnonevsQwen3.6 35B A3Bmedium Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 35B A3Bmedium Gemini 3 Flash PreviewnonevsNemotron 3 Ultra 550b A55bmediumFree Available Gemini 3.1 Flash Lite PreviewlowvsNemotron 3 Ultra 550b A55bmediumFree Available Nemotron 3 Ultra 550b A55bmediumFree AvailablevsQwen3.7 Maxnone Qwen3.6 35B A3BmediumvsStep 3.7 Flashlow Gemini 3.1 Flash Lite PreviewnonevsQwen3.6 35B A3Bmedium Gemini 3.5 FlashminimalvsNemotron 3 Ultra 550b A55bmediumFree Available Gemini 3.1 Flash LitelowvsQwen3.6 35B A3Bmedium Nemotron 3 Ultra 550b A55bmediumFree AvailablevsStep 3.7 Flashlow DeepSeek V4 FlashhighvsNemotron 3 Ultra 550b A55bmediumFree Available GPT-5.3 ChatnonevsQwen3.6 35B A3Bmedium