नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Qwen: Qwen3.5-Flash vs Xiaomi: MiMo-V2.5-Pro

सारांश

Qwen3.5-Flash vs MiMo-V2.5-Pro benchmark तुलना: Qwen3.5-Flash average score में आगे है: 6.1 vs 5.5. Qwen3.5-Flash की benchmark लागत कम है: $0.005 vs $0.017. MiMo-V2.5-Pro तेज है: 1.78s vs 3.58s, pass rates 39.7% vs 39.7%.

अनुशंसित मॉडल: Qwen3.5-Flash - It has the best score here (6.1), while costing about 3.9x less than MiMo-V2.5-Pro.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक Qwen3.5-Flash Qwen3.5-Flash none रिलीज़: 2026-02-24 MiMo-V2.5-Pro MiMo-V2.5-Pro none रिलीज़: 2026-04-22
स्कोर 6.1 5.5
रैंक #97 #119
विश्वसनीयता 10.0 10.0
संगति 9.7 8.6
सही परीक्षण
प्रति प्रयास पास दर 39.7% 39.7%
अस्थिर टेस्ट 1 4
कुल रन 63 63
प्रति परिणाम लागत 0.075 0.648
कुल लागत $0.005 $0.017
इनपुट कीमत $0.065 / 1M $0.435 / 1M
आउटपुट कीमत $0.260 / 1M $0.870 / 1M
कुल इनपुट टोकन 46,439 30,724
आउटपुट टोकन 4,276 3,043
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 3.58s 1.78s
प्रतिक्रिया समय (अधिकतम) 27.18s 8.32s
प्रतिक्रिया समय (कुल) 75.28s 37.42s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 Qwen3.5-Flash

none
लागत
$0.003
समय
47.4s
टोकन
7,799 tok

#119 MiMo-V2.5-Pro

none
लागत
$0.004
समय
46.4s
टोकन
4,025 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 3.5 8.3 8.3% 1 1.32s 696 690 0
MiMo-V2.5-Pro 3.3 8.1 8.3% 1 2.67s 645 994 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 5.5 10.0 33.3% 0 850ms 7,913 519 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 3.0 10.0 0.0% 0 6.22s 18,879 1,794 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 3.54s 4,695 596 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 10.0 10.0 100.0% 0 1.57s 7,794 243 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 1.32s 7,758 249 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 7.7 10.0 66.7% 0 905ms 789 15 0
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 877ms 753 27 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 10.0 10.0 100.0% 0 803ms 522 100 0
MiMo-V2.5-Pro 4.0 10.0 0.0% 0 2.58s 498 87 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 6.3 10.0 50.0% 0 8.81s 711 63 0
MiMo-V2.5-Pro 6.4 10.0 50.0% 0 1.03s 684 66 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 3.1 10.0 0.0% 0 10.89s 714 579 0
MiMo-V2.5-Pro 6.7 4.7 77.8% 2 1.30s 678 267 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 10.0 10.0 100.0% 0 3.67s 8,211 264 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.30s 8,238 258 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 3.0 10.0 0.0% 0 588ms 210 9 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 1.89s 216 14 0

त्वरित तुलना

तुलना जोड़ी बदलें