नेव्हिगेशन
Advertise here

Claude Haiku 5.5 (max) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) average score मध्ये पुढे आहे: 9.6 vs 8.5. GPT-6.1 Sol (low) चा benchmark खर्च कमी आहे: $0.460 vs $0.509. GPT-6.1 Sol (low) वेगवान आहे: 7.15s vs 61.71s, pass rates 85.5% vs 92.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#70
एकूण आउटपुट टोकन्स
919,699
प्रतिसाद वेळ (सरासरी)
61.71s
एकूण खर्च
$0.509
क्रमांक
#16
एकूण आउटपुट टोकन्स
13,138
प्रतिसाद वेळ (सरासरी)
7.15s
एकूण खर्च
$0.460
शिफारस केलेले मॉडेल GPT-6.1 Sol (low)

It has the best score here (9.6), while responding about 8.6x faster than Claude Haiku 5.5 (max).

तपशीलवार तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 max प्रकाशन: 2026-10-07 GPT-6.1 Sol GPT-6.1 Sol low प्रकाशन: 2026-09-29
स्कोअर 8.5 9.6
क्रमांक #70 #16
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 85.5% 92.8%
अस्थिर चाचण्या 1 1
एकूण रन 69 69
प्रति निकाल खर्च 2.677 2.187
एकूण खर्च $0.509 $0.460
इनपुट किंमत $0.100 / 1M $2.000 / 1M
आउटपुट किंमत $0.500 / 1M $10.000 / 1M
कॅश वाचण्याची किंमत $0.010 / 1M $0.100 / 1M
कॅश लिहिण्याची किंमत $0.125 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 487,516 163,900
आउटपुट टोकन्स 10,212 4,958
रिझनिंग टोकन्स 909,487 8,180
प्रतिसाद वेळ (सरासरी) 61.71s 7.15s
प्रतिसाद वेळ (कमाल) 288.94s 46.57s
प्रतिसाद वेळ (एकूण) 1419.40s 164.47s
पॅरामीटर्स ~50B ~2T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 Claude Haiku 5.5

max
OpenRouter returned no showcase content (finish_reason: error).
खर्च
$0.000
वेळ
164.5s
टोकन्स
0 tok

#16 GPT-6.1 Sol

low
खर्च
$0.028
वेळ
44.6s
टोकन्स
2,881 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Haiku 5.5 10.0 10.0 100.0% 0 55.87s 10,608 532 125,988
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

तुलना जोडी बदला