AI BENCHY
Advertise here
#50

GPT-5.6 Luna

OpenAI प्रकाशन: 2026-07-09 चाचणी तारीख: 2026-07-16 22:37 openai/gpt-5.6-luna::medium
(high) (medium) (low) (none)

सारांश

GPT-5.6 Luna AI BENCHY वर 7.6 स्कोर करते आणि #50 वर आहे. याची reliability 10.0, pass rate 65.2%, एकूण खर्च $0.352, आणि सरासरी response time 7.28s आहे.

सुसंगतता

9.6

एकूण आउटपुट टोकन्स

43,679

एकूण इनपुट टोकन्स

89,676

इनपुट किंमत

$1.000 / 1M

आउटपुट किंमत

$6.000 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 8

प्रति प्रयत्न पास दर: 65.2%

अस्थिर चाचण्या

1

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

7.28s

प्रतिसाद वेळ (कमाल): 29.85s

प्रतिसाद वेळ (एकूण): 160.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 GPT-5.6 Luna

medium
खर्च
$0.014
वेळ
14.6s
टोकन्स
2,362 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-07-16 22:37 नवीन चाचणी जोडली 7.6 10.0 $0.352 सध्याची रन
2026-07-09 21:16 पहिला रन 7.6 10.0 $0.258 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत
2026-07-09 21:18 $1.000 / 1M $6.000 / 1M

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 8.3 10.0
कोडिंग 5.4 7.2
संयुक्त 10.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.3 10.0
Samanya Buddhimatta 5.1 10.0
सूचनांचे पालन 9.9 10.0
कोडी सोडवणे 7.8 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स