नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Haiku 5.5 (max) vs Qwen3.8 Max (0902) (low)

Qwen3.8 Max (0902) (low) average score में आगे है: 8.6 vs 8.5. Claude Haiku 5.5 (max) की benchmark लागत कम है: $0.509 vs $1.131. Qwen3.8 Max (0902) (low) तेज है: 29.07s vs 61.71s, pass rates 85.5% vs 85.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#70
कुल आउटपुट टोकन
919,699
प्रतिक्रिया समय (औसत)
61.71s
कुल लागत
$0.509
रैंक
#65
कुल आउटपुट टोकन
88,923
प्रतिक्रिया समय (औसत)
29.07s
कुल लागत
$1.131
अनुशंसित मॉडल Claude Haiku 5.5 (max)

Its score stays close to the best score here (8.5 vs 8.6), while costing about 2.2x less than Qwen3.8 Max (0902) (low).

विस्तृत तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 max रिलीज़: 2026-10-07 Qwen3.8 Max (0902) Qwen3.8 Max (0902) low रिलीज़: 2026-09-07
स्कोर 8.5 8.6
रैंक #70 #65
विश्वसनीयता 10.0 10.0
संगति 9.6 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 85.5% 85.5%
अस्थिर टेस्ट 1 3
कुल रन 69 69
प्रति परिणाम लागत 2.677 6.283
कुल लागत $0.509 $1.131
इनपुट कीमत $0.100 / 1M $2.000 / 1M
आउटपुट कीमत $0.500 / 1M $6.000 / 1M
कैश पढ़ने की कीमत $0.010 / 1M $0.250 / 1M
कैश लिखने की कीमत $0.125 / 1M $2.500 / 1M
कुल इनपुट टोकन 487,516 298,682
आउटपुट टोकन 10,212 8,374
रीजनिंग टोकन 909,487 80,549
प्रतिक्रिया समय (औसत) 61.71s 29.07s
प्रतिक्रिया समय (अधिकतम) 288.94s 207.79s
प्रतिक्रिया समय (कुल) 1419.40s 668.66s
पैरामीटर ~50B 2.4T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 Claude Haiku 5.5

max
OpenRouter returned no showcase content (finish_reason: error).
लागत
$0.000
समय
164.5s
टोकन
0 tok

#65 Qwen3.8 Max (0902)

low
लागत
$0.014
समय
41.2s
टोकन
2,421 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Haiku 5.5 10.0 10.0 100.0% 0 55.87s 10,608 532 125,988
Qwen3.8 Max (0902) 10.0 10.0 100.0% 0 37.42s 8,127 485 17,404

तुलना जोड़ी बदलें