नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Cobuddy vs Qwen: Qwen3.5-9B

Cobuddy (medium) average score में आगे है: 4.7 vs 3.8. Cobuddy (medium) की benchmark लागत कम है: $0.000 vs $0.036. Cobuddy (medium) तेज है: 39.90s vs 82.24s, pass rates 45.5% vs 25.8%.

अनुशंसित मॉडलCobuddy (medium)It has the best score here (4.7), while responding about 2.1x faster than Qwen3.5-9B (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Cobuddy Cobuddy medium रिलीज़: 2026-05-06 Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02
स्कोर 4.7 3.8
रैंक #203 #220
विश्वसनीयता 10.0 5.0
संगति 7.2 8.1
सही परीक्षण
प्रति प्रयास पास दर 45.5% 25.8%
अस्थिर टेस्ट 6 5
कुल रन 63 66
प्रति परिणाम लागत 0.000 1.187
कुल लागत $0.000 $0.036
इनपुट कीमत $0.000 / 1M $0.100 / 1M
आउटपुट कीमत $0.000 / 1M $0.150 / 1M
कुल इनपुट टोकन 37,449 17,070
आउटपुट टोकन 1,677 29,045
रीजनिंग टोकन 116,703 209,516
प्रतिक्रिया समय (औसत) 39.90s 82.24s
प्रतिक्रिया समय (अधिकतम) 309.02s 226.38s
प्रतिक्रिया समय (कुल) 797.98s 1315.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#203 Cobuddy

medium
No endpoints found for baidu/cobuddy:free.
लागत
$0.000
समय
0.1s
टोकन
0 tok

#220 Qwen3.5-9B

medium
लागत
$0.001
समय
35.9s
टोकन
3,030 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

त्वरित तुलना

तुलना जोड़ी बदलें