Compare Charts

Language:

❤️ Made by XCS

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs Qwen: Qwen3.5 Plus 2026-02-15

Model Name:

Last updated at : 2026-02-27 15:16

Summary

Metric	ByteDance Seed: Seed-2.0-Mini medium Release: 2026-02-26	Qwen: Qwen3.5 Plus 2026-02-15 medium Release: Unknown release date
Rank	#18	#4
Score	6.13	8.64
Consistency	8.91	10.00
Cost per result	0.177	1.955
Total Cost	$0.013	$0.235
Tests Correct
Wrong Tests	7	2
Attempt pass rate	59.5%	85.7%
Flaky tests	2	0
Output Tokens	1,353	1,258
Reasoning Tokens	24,362	93,374

Category Breakdown

Anti-AI Tricks	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Output Tokens	Reasoning Tokens
ByteDance Seed: Seed-2.0-Mini	7.00	9.99	66.7%	0		354	9,352
Qwen: Qwen3.5 Plus 2026-02-15	10.00	10.00	100.0%	0		186	5,926

Data parsing and extraction	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Output Tokens	Reasoning Tokens
ByteDance Seed: Seed-2.0-Mini	9.88	10.00	100.0%	0		246	2,743
Qwen: Qwen3.5 Plus 2026-02-15	10.00	10.00	100.0%	0		283	14,892

Domain specific	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Output Tokens	Reasoning Tokens
ByteDance Seed: Seed-2.0-Mini	1.00	10.00	0.0%	0		0	0
Qwen: Qwen3.5 Plus 2026-02-15	4.00	10.00	33.3%	0		56	39,882

Instructions following	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Output Tokens	Reasoning Tokens
ByteDance Seed: Seed-2.0-Mini	8.00	9.99	50.0%	0		69	2,050
Qwen: Qwen3.5 Plus 2026-02-15	9.50	9.99	100.0%	0		102	9,257

Puzzle Solving	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Output Tokens	Reasoning Tokens
ByteDance Seed: Seed-2.0-Mini	5.33	4.91	77.8%	2		462	4,982
Qwen: Qwen3.5 Plus 2026-02-15	10.00	10.00	100.0%	0		322	22,508

Tool Calling	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Output Tokens	Reasoning Tokens
ByteDance Seed: Seed-2.0-Mini	10.00	10.00	100.0%	0		222	5,235
Qwen: Qwen3.5 Plus 2026-02-15	10.00	10.00	100.0%	0		309	909

Switch Comparison Pair

Compare ByteDance Seed: Seed-2.0-Mini against...

Compare Qwen: Qwen3.5 Plus 2026-02-15 against...