AI BENCHY Compare

Qwen: Qwen3.7 Plus vs Xiaomi: MiMo-V2.5

सारांश

Qwen3.7 Plus vs MiMo-V2.5 benchmark तुलना: Qwen3.7 Plus average score मध्ये पुढे आहे: 7.2 vs 6.7. Qwen3.7 Plus चा benchmark खर्च कमी आहे: $0.023 vs $0.063. Qwen3.7 Plus वेगवान आहे: 2.85s vs 27.11s, pass rates 47.6% vs 69.8%.

शिफारस केलेले मॉडेल: Qwen3.7 Plus - It has the best score here (7.2), while costing about 2.8x less than MiMo-V2.5.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक	Qwen3.7 Plus Qwen3.7 Plus none प्रकाशन: 2026-06-03	MiMo-V2.5 MiMo-V2.5 medium प्रकाशन: 2026-04-22

मेट्रिक	Qwen3.7 Plus Qwen3.7 Plus none प्रकाशन: 2026-06-03	MiMo-V2.5 MiMo-V2.5 medium प्रकाशन: 2026-04-22
स्कोअर	7.2	6.7
क्रमांक	#60	#76
विश्वसनीयता	10.0	10.0
सुसंगतता	10.0	8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर	47.6%	69.8%
अस्थिर चाचण्या	0	5
एकूण रन	63	63
प्रति निकाल खर्च	0.276	2.966
एकूण खर्च	$0.023	$0.063
इनपुट किंमत	$0.320 / 1M	$0.140 / 1M
आउटपुट किंमत	$1.280 / 1M	$0.280 / 1M
एकूण इनपुट टोकन्स	42,510	41,838
आउटपुट टोकन्स	6,578	2,827
रिझनिंग टोकन्स	0	198,898
प्रतिसाद वेळ (सरासरी)	2.85s	27.11s
प्रतिसाद वेळ (कमाल)	29.38s	162.44s
प्रतिसाद वेळ (एकूण)	59.86s	569.38s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 Qwen3.7 Plus

none

खर्च: $0.019
वेळ: 213.5s
टोकन्स: 11,960 tok

#76 MiMo-V2.5

medium

खर्च: $0.002
वेळ: 54.8s
टोकन्स: 5,247 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	6.5	10.0	50.0%	0		1.38s	696	349	0
MiMo-V2.5	10.0	10.0	100.0%	0		4.14s	621	281	1,739

कोडिंग	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	5.5	10.0	33.3%	0		2.15s	7,911	639	0
MiMo-V2.5	6.2	4.7	66.7%	2		97.14s	7,422	557	81,977

संयुक्त	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	10.0	10.0	100.0%	0		29.38s	14,952	4,505	0
MiMo-V2.5	10.0	10.0	100.0%	0		16.86s	15,060	363	7,609

डेटा पार्सिंग आणि निष्कर्षण	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	10.0	10.0	100.0%	0		1.43s	7,794	243	0
MiMo-V2.5	2.7	5.7	16.7%	1		6.33s	7,746	306	5,714

डोमेन-विशिष्ट	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	3.0	10.0	0.0%	0		868ms	789	18	0
MiMo-V2.5	5.3	10.0	33.3%	0		34.53s	735	507	49,478

Samanya Buddhimatta	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	5.3	10.0	0.0%	0		1.33s	522	78	0
MiMo-V2.5	5.4	2.5	66.7%	1		5.37s	492	121	418

सूचनांचे पालन	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	6.3	10.0	50.0%	0		929ms	711	72	0
MiMo-V2.5	9.9	10.0	100.0%	0		1.80s	672	88	801

कोडी सोडवणे	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	7.7	10.0	66.7%	0		1.71s	714	443	0
MiMo-V2.5	8.2	7.2	88.9%	1		20.25s	660	279	33,254

टूल कॉलिंग	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	10.0	10.0	100.0%	0		3.54s	8,211	222	0
MiMo-V2.5	10.0	10.0	100.0%	0		7.29s	8,220	303	2,424

सामान्य ज्ञान	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
Qwen3.7 Plus	3.0	10.0	0.0%	0		1.21s	210	9	0
MiMo-V2.5	3.0	10.0	0.0%	0		51.29s	210	22	15,484

झटपट तुलना

तुलना जोडी बदला

Gemma 4 26B A4Bmediumमोफत उपलब्धvsQwen3.7 Plusnone Qwen3.7 PlusnonevsStep 3.7 Flashhigh Qwen3.7 PlusnonevsGLM 5.1medium Gemini 3.5 FlashminimalvsMiMo-V2.5medium Qwen3.7 MaxnonevsMiMo-V2.5medium Kimi K2.7 CodemediumvsQwen3.7 Plusnone Qwen3.7 PlusnonevsGrok 4.20medium Gemini 3 Flash PreviewnonevsMiMo-V2.5medium Gemini 3 Flash PreviewlowvsQwen3.7 Plusnone Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2.5medium Qwen3.7 PlusnonevsMiMo-V2.5-Promedium Seed-2.0-MinimediumvsQwen3.7 Plusnone