AI BENCHY Compare

inclusionAI: Ling-2.6-flash vs OpenAI: gpt-oss-120b

Résumé

Comparaison benchmark Ling-2.6-flash vs gpt-oss-120b : gpt-oss-120b mène au score moyen avec 6.1 vs 5.0. Ling-2.6-flash a le coût de benchmark le plus bas avec $0.001 vs $0.013. Ling-2.6-flash est plus rapide avec 9.34s vs 22.28s, avec des taux de réussite de 31.8% vs 52.4%.

Modèle recommandé: Ling-2.6-flash - Il offre le meilleur compromis global: score compétitif (5.0), coût inférieur à gpt-oss-120b et temps de réponse équilibré.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-04

Métrique	Ling-2.6-flash Ling-2.6-flash none Sortie: 2026-04-21	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement

Métrique	Ling-2.6-flash Ling-2.6-flash none Sortie: 2026-04-21	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement
Score	5.0	6.1
Rang	#138	#99
Fiabilité	10.0	10.0
Cohérence	9.2	8.0
Tests corrects
Taux de réussite par tentative	31.8%	52.4%
Tests instables	2	5
Exécutions totales	63	63
Coût par résultat	0.005	0.141
Coût total	$0.001	$0.013
Prix d'entrée	$0.010 / 1M	$0.039 / 1M
Prix de sortie	$0.030 / 1M	$0.180 / 1M
Total des jetons d'entrée	40,718	39,084
Jetons de sortie	2,878	20,013
Jetons de raisonnement	0	50,233
Temps de réponse (moy.)	9.34s	22.28s
Temps de réponse (max)	35.34s	68.16s
Temps de réponse (total)	177.48s	311.96s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Ling-2.6-flash

none

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

#99 gpt-oss-120b

medium

Cost: $0.001
Time: 26.7s
Tokens: 555 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	6.8	8.1	58.3%	1		11.81s	726	573	0
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	1,314	3,518	2,177

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	5.3	10.0	33.3%	0		11.21s	813	381	0
gpt-oss-120b	5.9	7.0	55.6%	1		38.37s	7,782	3,365	11,973

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	3.0	10.0	0.0%	0		35.34s	20,818	1,069	0
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	11,535	694	5,072

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	6.5	10.0	50.0%	0		8.48s	8,004	246	0
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	7,476	241	1,114

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	3.0	10.0	0.0%	0		4.95s	810	24	0
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	1,266	6,784	20,606

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	4.0	10.0	0.0%	0		1.45s	540	109	0
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	659	107	387

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	9.8	10.0	100.0%	0		5.52s	732	81	0
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	1,036	126	1,799

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	2.9	7.2	11.1%	1		6.51s	729	151	0
gpt-oss-120b	5.3	7.2	44.4%	1		21.71s	1,190	1,790	2,264

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	3.0	10.0	0.0%	0		18.80s	7,324	229	0
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	6,514	287	1,083

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	3.0	10.0	0.0%	0		1.06s	222	15	0
gpt-oss-120b	3.0	10.0	0.0%	0		26.51s	312	3,101	3,758

Comparaison rapide

Changer la paire de comparaison