AI BENCHY
Advertise here
#5

GPT-5.6 Sol

OpenAI प्रकाशन: 2026-07-09 चाचणी तारीख: 2026-07-16 22:38 openai/gpt-5.6-sol::low

सारांश

GPT-5.6 Sol AI BENCHY वर 9.5 स्कोर करते आणि #5 वर आहे. याची reliability 10.0, pass rate 86.4%, एकूण खर्च $0.971, आणि सरासरी response time 8.79s आहे.

GPT-5.6 Sol खास का आहे: हे एकूणात सर्वाधिक rank असलेल्या मॉडेल्सपैकी एक आहे. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.

सुसंगतता

9.2

एकूण आउटपुट टोकन्स

19,246

एकूण इनपुट टोकन्स

78,571

इनपुट किंमत

$5.000 / 1M

आउटपुट किंमत

$30.000 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 4

प्रति प्रयत्न पास दर: 86.4%

अस्थिर चाचण्या

2

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

8.79s

प्रतिसाद वेळ (कमाल): 53.91s

प्रतिसाद वेळ (एकूण): 193.33s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#5 GPT-5.6 Sol

low
खर्च
$0.062
वेळ
26.7s
टोकन्स
2,150 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-07-16 22:38 नवीन चाचणी जोडली 9.5 10.0 $0.971 सध्याची रन
2026-07-09 21:16 पहिला रन 9.5 10.0 $0.649 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत
2026-07-09 21:18 $5.000 / 1M $30.000 / 1M

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 8.3 10.0
कोडिंग 10.0 10.0
संयुक्त 10.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.3 7.2
Samanya Buddhimatta 10.0 10.0
सूचनांचे पालन 10.0 10.0
कोडी सोडवणे 8.2 7.2
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 10.0 10.0

तुलना केलेली मॉडेल्स