AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3 Coder Next

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-17

Metrică	GPT-5.4 Mini GPT-5.4 Mini none Lansare: 2026-03-17	Qwen3 Coder Next Qwen3 Coder Next none Lansare: 2026-02-03

Metrică	GPT-5.4 Mini GPT-5.4 Mini none Lansare: 2026-03-17	Qwen3 Coder Next Qwen3 Coder Next none Lansare: 2026-02-03
Rang	#66	#64
Scor	4.8	5.0
Consistență	8.6	10.0
Cost per rezultat	0.737	0.175
Cost total	$0.030	$0.007
Teste corecte
Rată de trecere pe încercare	31.4%	23.5%
Teste instabile	3	0
Rulări totale	51	51
Tokenuri de ieșire	2,085	3,032
Tokenuri de raționament	0	0
Timp de răspuns (mediu)	1.17s	10.82s
Timp de răspuns (maxim)	2.52s	45.14s
Timp de răspuns (total)	19.82s	118.99s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Mini	3.1	8.1	8.3%	1		929ms	654	0
Qwen3 Coder Next	3.6	10.0	0.0%	0		3.31s	1,321	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Mini	3.0	10.0	0.0%	0		2.52s	298	0
Qwen3 Coder Next	3.0	10.0	0.0%	0		45.14s	317	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Mini	10.0	10.0	100.0%	0		1.30s	222	0
Qwen3 Coder Next	6.5	10.0	50.0%	0		1.32s	246	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Mini	3.5	4.4	33.3%	2		937ms	88	0
Qwen3 Coder Next	5.3	10.0	33.3%	0		962ms	26	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Mini	4.8	10.0	0.0%	0		1.82s	174	0
Qwen3 Coder Next	10.0	10.0	100.0%	0		1.34s	152	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Mini	6.3	10.0	50.0%	0		728ms	101	0
Qwen3 Coder Next	4.8	10.0	0.0%	0		7.71s	63	0

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Mini	5.4	10.0	33.3%	0		860ms	293	0
Qwen3 Coder Next	3.2	10.0	0.0%	0		22.86s	652	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Mini	3.0	10.0	0.0%	0		2.32s	255	0
Qwen3 Coder Next	10.0	10.0	100.0%	0		2.47s	255	0

Comparație rapidă

Schimbă perechea de comparație

GPT-5.4 MininonevsQwen3 Coder Nextmedium GPT-5.4 MininonevsGLM 4.7 Flashmedium Qwen3 Coder NextnonevsGLM 4.7 Flashmedium GPT-5.4 MininonevsQwen3.5-9Bmedium Mistral Small 4mediumvsQwen3 Coder Nextnone Mistral Small 4mediumvsGPT-5.4 Mininone MiniMax M2.5mediumDisponibil gratuitvsQwen3 Coder Nextnone gpt-oss-120bmediumDisponibil gratuitvsQwen3 Coder Nextnone MiniMax M2.5mediumDisponibil gratuitvsGPT-5.4 Mininone Qwen3 Coder NextnonevsGrok 4.20 Multi-Agent Betamedium GPT-5 NanomediumvsQwen3 Coder Nextnone Mercury 2mediumvsQwen3 Coder Nextnone