नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Haiku 5.5 (low) vs GPT-5.2 (medium)

GPT-5.2 (medium) average score में आगे है: 8.7 vs 8.6. Claude Haiku 5.5 (low) की benchmark लागत कम है: $0.061 vs $1.558. Claude Haiku 5.5 (low) तेज है: 7.51s vs 31.29s, pass rates 76.8% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#64
कुल आउटपुट टोकन
61,650
प्रतिक्रिया समय (औसत)
7.51s
कुल लागत
$0.061
रैंक
#55
कुल आउटपुट टोकन
80,538
प्रतिक्रिया समय (औसत)
31.29s
कुल लागत
$1.558
अनुशंसित मॉडल Claude Haiku 5.5 (low)

Its score stays close to the best score here (8.6 vs 8.7), while costing about 25.8x less than GPT-5.2 (medium).

विस्तृत तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 low रिलीज़: 2026-10-07 GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11
स्कोर 8.6 8.7
रैंक #64 #55
विश्वसनीयता 10.0 10.0
संगति 8.9 8.5
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 76.8% 73.9%
अस्थिर टेस्ट 3 4
कुल रन 69 69
प्रति परिणाम लागत 0.378 10.261
कुल लागत $0.061 $1.558
इनपुट कीमत $0.100 / 1M $1.750 / 1M
आउटपुट कीमत $0.500 / 1M $14.000 / 1M
कैश पढ़ने की कीमत $0.010 / 1M $0.175 / 1M
कैश लिखने की कीमत $0.125 / 1M लागू नहीं
कुल इनपुट टोकन 296,301 235,207
आउटपुट टोकन 10,672 11,065
रीजनिंग टोकन 50,978 69,473
प्रतिक्रिया समय (औसत) 7.51s 31.29s
प्रतिक्रिया समय (अधिकतम) 44.43s 116.86s
प्रतिक्रिया समय (कुल) 172.74s 531.98s
पैरामीटर ~50B ~1.2T कुल (~80B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 Claude Haiku 5.5

low
लागत
$0.001
समय
7.4s
टोकन
1,851 tok

#55 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Haiku 5.5 7.9 7.5 77.8% 1 7.30s 10,608 531 11,618
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

तुलना जोड़ी बदलें