AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.5-122B-A10B

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-01

Metrică	gpt-oss-120b gpt-oss-120b medium Lansare: 2025-08-05 Disponibil gratuit	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lansare: 2026-02-24

Metrică	gpt-oss-120b gpt-oss-120b medium Lansare: 2025-08-05 Disponibil gratuit	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lansare: 2026-02-24
Scor	5.9	5.4
Rang	#103	#131
Fiabilitate	10.0	10.0
Consistență	7.9	9.5
Teste corecte
Rată de trecere pe încercare	50.0%	33.3%
Teste instabile	5	1
Rulări totale	60	60
Cost per rezultat	0.151	0.380
Cost total	$0.012	$0.019
Preț de intrare	$0.000 / 1M	$0.260 / 1M
Preț de ieșire	$0.000 / 1M	$2.080 / 1M
Tokenuri de ieșire	17,495	3,374
Tokenuri de raționament	46,878	0
Timp de răspuns (mediu)	22.41s	3.38s
Timp de răspuns (maxim)	68.16s	46.00s
Timp de răspuns (total)	291.35s	67.55s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	3,518	2,177
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	312	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	3.9	5.6	33.3%	1		47.24s	847	8,618
Qwen3.5-122B-A10B	4.0	5.5	33.3%	1		2.14s	684	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	694	5,072
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	1,137	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	241	1,114
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	243	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	6,784	20,606
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	15	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	107	387
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	66	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	126	1,799
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	69	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	5.3	7.2	44.4%	1		21.71s	1,790	2,264
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	575	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	287	1,083
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	264	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
gpt-oss-120b	3.0	10.0	0.0%	0		26.51s	3,101	3,758
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	9	0

Comparație rapidă

Schimbă perechea de comparație

gpt-oss-120bmediumDisponibil gratuitvsQwen3.5-Flashnone gpt-oss-120bmediumDisponibil gratuitvsGLM 5V Turbonone MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone Elephant AlphamediumvsQwen3.5-122B-A10Bnone Seed-2.0-Litenonevsgpt-oss-120bmediumDisponibil gratuit Mistral Small 4mediumvsQwen3.5-122B-A10Bnone gpt-oss-120bmediumDisponibil gratuitvsGLM 5.1none MiniMax M2.5mediumvsQwen3.5-122B-A10Bnone DeepSeek V4 Prononevsgpt-oss-120bmediumDisponibil gratuit gpt-oss-120bmediumDisponibil gratuitvsQwen3.5 Plus 2026-04-20none gpt-oss-120bmediumDisponibil gratuitvsQwen3.5-35B-A3Bnone gpt-oss-120bmediumDisponibil gratuitvsQwen3.5-27Bnone