नेविगेशन
Advertise here

Claude Haiku 5.5 (low) vs GPT-6 Sol (low)

GPT-6 Sol (low) average score में आगे है: 8.7 vs 8.6. Claude Haiku 5.5 (low) की benchmark लागत कम है: $0.061 vs $0.477. Claude Haiku 5.5 (low) तेज है: 7.51s vs 8.72s, pass rates 76.8% vs 87.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#64
कुल आउटपुट टोकन
61,650
प्रतिक्रिया समय (औसत)
7.51s
कुल लागत
$0.061
रैंक
#59
कुल आउटपुट टोकन
13,211
प्रतिक्रिया समय (औसत)
8.72s
कुल लागत
$0.477
अनुशंसित मॉडल Claude Haiku 5.5 (low)

Its score stays close to the best score here (8.6 vs 8.7), while costing about 7.9x less than GPT-6 Sol (low).

विस्तृत तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 low रिलीज़: 2026-10-07 GPT-6 Sol GPT-6 Sol low रिलीज़: 2026-09-23
स्कोर 8.6 8.7
रैंक #64 #59
विश्वसनीयता 10.0 10.0
संगति 8.9 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 76.8% 87.0%
अस्थिर टेस्ट 3 4
कुल रन 69 69
प्रति परिणाम लागत 0.378 2.650
कुल लागत $0.061 $0.477
इनपुट कीमत $0.100 / 1M $2.000 / 1M
आउटपुट कीमत $0.500 / 1M $10.000 / 1M
कैश पढ़ने की कीमत $0.010 / 1M $0.200 / 1M
कैश लिखने की कीमत $0.125 / 1M $2.500 / 1M
कुल इनपुट टोकन 296,301 172,359
आउटपुट टोकन 10,672 5,026
रीजनिंग टोकन 50,978 8,185
प्रतिक्रिया समय (औसत) 7.51s 8.72s
प्रतिक्रिया समय (अधिकतम) 44.43s 48.43s
प्रतिक्रिया समय (कुल) 172.74s 200.61s
पैरामीटर ~50B ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 Claude Haiku 5.5

low
लागत
$0.001
समय
7.4s
टोकन
1,851 tok

#59 GPT-6 Sol

low
लागत
$0.018
समय
17.4s
टोकन
1,850 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Haiku 5.5 7.9 7.5 77.8% 1 7.30s 10,608 531 11,618
GPT-6 Sol 6.2 4.8 66.7% 2 8.74s 7,302 405 1,296

तुलना जोड़ी बदलें