नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.5-27B vs Qwen: Qwen3.5 Plus 2026-02-15

average score लगभग बराबर है: 7.4 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium) की benchmark लागत कम है: $0.437 vs $0.981. Qwen3.5 Plus 2026-02-15 (medium) तेज है: 89.19s vs 111.94s, pass rates 72.7% vs 71.2%.

अनुशंसित मॉडलQwen3.5 Plus 2026-02-15 (medium)It has the best score here (7.5), while costing about 2.2x less than Qwen3.5-27B (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium रिलीज़: 2026-02-15
स्कोर 7.4 7.5
रैंक #66 #65
विश्वसनीयता 10.0 10.0
संगति 8.2 8.5
सही परीक्षण
प्रति प्रयास पास दर 72.7% 71.2%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 8.324 3.348
कुल लागत $0.981 $0.437
इनपुट कीमत $0.195 / 1M $0.260 / 1M
आउटपुट कीमत $1.560 / 1M $1.560 / 1M
कुल इनपुट टोकन 111,635 113,560
आउटपुट टोकन 15,999 9,823
रीजनिंग टोकन 598,430 250,881
प्रतिक्रिया समय (औसत) 111.94s 89.19s
प्रतिक्रिया समय (अधिकतम) 1026.43s 304.85s
प्रतिक्रिया समय (कुल) 2462.67s 1337.92s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

#65 Qwen3.5 Plus 2026-02-15

medium
लागत
$0.011
समय
125.5s
टोकन
7,040 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

त्वरित तुलना

तुलना जोड़ी बदलें