नेव्हिगेशन
Advertise here

तुलना केलेली मॉडेल्स

GPT-5.6 Sol (low) vs Grok 4.6 (high) vs Claude Opus 5 (high) benchmark तुलना: GPT-5.6 Sol (low) स्कोअर मध्ये 9.5 सह आघाडीवर आहे. GPT-5.6 Sol (low) विश्वसनीयता मध्ये 10.0 सह आघाडीवर आहे. GPT-5.6 Sol (low) चे एकूण खर्च सर्वात कमी आहे: $0.357. GPT-5.6 Sol (low) 9.04s वर सर्वात जलद आहे.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-24

तुलना केलेली मॉडेल्स

क्रमांक
#9
एकूण आउटपुट टोकन्स
19,946
प्रतिसाद वेळ (सरासरी)
9.04s
एकूण खर्च
$0.357
क्रमांक
#19
एकूण आउटपुट टोकन्स
282,217
प्रतिसाद वेळ (सरासरी)
84.15s
एकूण खर्च
$1.908
क्रमांक
#24
एकूण आउटपुट टोकन्स
95,583
प्रतिसाद वेळ (सरासरी)
22.51s
एकूण खर्च
$3.070
शिफारस केलेले मॉडेल GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 7.0x less than या तुलनेतील इतर मॉडेल.

तपशीलवार तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol low प्रकाशन: 2026-07-09 Grok 4.6 Grok 4.6 high प्रकाशन: 2026-08-12 Claude Opus 5 Claude Opus 5 high प्रकाशन: 2026-07-25
स्कोअर 9.5 9.3 9.2
क्रमांक #9 #19 #24
विश्वसनीयता 10.0 10.0 10.0
सुसंगतता 9.2 10.0 10.0
प्रयत्न 66/66 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 86.4% 86.4% 81.8%
अस्थिर चाचण्या 2 0 0
एकूण रन 66 66 66
प्रति निकाल खर्च 5.508 10.042 17.052
एकूण खर्च $0.357 $1.908 $3.070
इनपुट किंमत $2.000 / 1M $2.000 / 1M $5.000 / 1M
आउटपुट किंमत $10.000 / 1M $6.000 / 1M $25.000 / 1M
एकूण इनपुट टोकन्स 78,580 107,275 135,956
आउटपुट टोकन्स 4,476 5,094 64,624
रिझनिंग टोकन्स 15,470 277,123 30,959
प्रतिसाद वेळ (सरासरी) 9.04s 84.15s 22.51s
प्रतिसाद वेळ (कमाल) 53.91s 618.49s 159.01s
प्रतिसाद वेळ (एकूण) 198.97s 1851.26s 495.12s
पॅरामीटर्स ~2T एकूण (~150B सक्रिय) ~1.7T एकूण (~170B सक्रिय) ~5T एकूण (~500B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.6 Sol

low
खर्च
$0.062
वेळ
26.7s
टोकन्स
2,150 tok

#19 SpaceXAI: Grok 4.6

high
खर्च
$0.107
वेळ
265.1s
टोकन्स
18,001 tok

#24 Claude Opus 5

high
खर्च
$0.265
वेळ
144.5s
टोकन्स
10,741 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721

झटपट तुलना

तुलना जोडी बदला