नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Qwen: Qwen3.5-9B vs Xiaomi: MiMo-V2-Flash

सारांश

Qwen3.5-9B vs MiMo-V2-Flash benchmark तुलना: MiMo-V2-Flash average score में आगे है: 4.6 vs 4.2. MiMo-V2-Flash की benchmark लागत कम है: $0.025 vs $0.036. MiMo-V2-Flash तेज है: 2.76s vs 82.24s, pass rates 27.0% vs 25.4%.

अनुशंसित मॉडल: MiMo-V2-Flash - It has the best score here (4.6), while responding about 29.8x faster than Qwen3.5-9B.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-10

मेट्रिक Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02 MiMo-V2-Flash MiMo-V2-Flash none रिलीज़: 2025-12-16
स्कोर 4.2 4.6
रैंक #162 #153
विश्वसनीयता 6.7 6.7
संगति 8.0 8.5
सही परीक्षण
प्रति प्रयास पास दर 27.0% 25.4%
अस्थिर टेस्ट 5 4
कुल रन 63 63
प्रति परिणाम लागत 1.187 0.584
कुल लागत $0.036 $0.025
इनपुट कीमत $0.100 / 1M $0.100 / 1M
आउटपुट कीमत $0.150 / 1M $0.300 / 1M
कुल इनपुट टोकन 17,070 36,851
आउटपुट टोकन 29,045 68,882
रीजनिंग टोकन 209,516 0
प्रतिक्रिया समय (औसत) 82.24s 2.76s
प्रतिक्रिया समय (अधिकतम) 226.38s 19.68s
प्रतिक्रिया समय (कुल) 1315.88s 46.99s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#162 Qwen3.5-9B

medium
Cost
$0.001
Time
35.9s
Tokens
3,030 tok

#153 MiMo-V2-Flash

none
Cost
$0.001
Time
7.7s
Tokens
1,481 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 5.1 5.8 50.0% 2 34.44s 369 2,621 12,411
MiMo-V2-Flash 3.2 8.0 8.3% 1 1.19s 645 865 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
MiMo-V2-Flash 4.3 7.9 11.1% 1 2.64s 7,442 763 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0 0
MiMo-V2-Flash 3.0 10.0 0.0% 0 2.87s 15,075 330 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 4,722 1,383 32,113
MiMo-V2-Flash 2.9 5.8 16.7% 1 19.68s 2,622 161 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 295 11,549 48,475
MiMo-V2-Flash 5.3 7.2 44.4% 1 564ms 753 24 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 180 0 30,695
MiMo-V2-Flash 4.6 10.0 0.0% 0 1.67s 498 104 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 6.5 10.0 50.0% 0 5.75s 381 491 1,824
MiMo-V2-Flash 6.5 10.0 50.0% 0 857ms 684 69 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.0 10.0 0.0% 0 32.27s 376 1,593 12,026
MiMo-V2-Flash 5.3 10.0 33.3% 0 1.86s 678 66,282 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 8,283 444 1,149
MiMo-V2-Flash 10.0 10.0 100.0% 0 2.28s 8,238 272 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-9B 3.0 10.0 0.0% 0 177.02s 68 3,074 29,694
MiMo-V2-Flash 3.0 10.0 0.0% 0 1.82s 216 12 0

त्वरित तुलना

तुलना जोड़ी बदलें