नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna vs Laguna S 2.1 (high)

average score जवळपास समान आहे: 5.4 vs 5.4. GPT-5.6 Luna चा benchmark खर्च कमी आहे: $0.029 vs $0.114. GPT-5.6 Luna वेगवान आहे: 1.50s vs 111.60s, pass rates 36.4% vs 27.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-04

क्रमांक
#241
एकूण आउटपुट टोकन्स
6,709
प्रतिसाद वेळ (सरासरी)
1.50s
एकूण खर्च
$0.029
क्रमांक
#245
एकूण आउटपुट टोकन्स
584,864
प्रतिसाद वेळ (सरासरी)
111.60s
एकूण खर्च
$0.114
शिफारस केलेले मॉडेल GPT-5.6 Luna

It has the best score here (5.4), while costing about 4.0x less than Laguna S 2.1 (high).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none प्रकाशन: 2026-07-09 Laguna S 2.1 Laguna S 2.1 high प्रकाशन: 2026-07-21 मोफत उपलब्ध
स्कोअर 5.4 5.4
क्रमांक #241 #245
विश्वसनीयता 10.0 10.0
सुसंगतता 8.8 8.1
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 36.4% 27.3%
अस्थिर चाचण्या 3 5
एकूण रन 66 66
प्रति निकाल खर्च 2.357 3.153
एकूण खर्च $0.029 $0.114
इनपुट किंमत $0.200 / 1M $0.090 / 1M
आउटपुट किंमत $1.200 / 1M $0.180 / 1M
एकूण इनपुट टोकन्स 101,332 208,937
आउटपुट टोकन्स 6,709 175,588
रिझनिंग टोकन्स 0 409,276
प्रतिसाद वेळ (सरासरी) 1.50s 111.60s
प्रतिसाद वेळ (कमाल) 10.57s 1190.11s
प्रतिसाद वेळ (एकूण) 33.05s 2455.24s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 118B एकूण (8B सक्रिय)
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#241 GPT-5.6 Luna

none
खर्च
$0.016
वेळ
15.8s
टोकन्स
2,685 tok

#245 Laguna S 2.1

high
खर्च
$0.001
वेळ
6.8s
टोकन्स
1,389 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009

झटपट तुलना

तुलना जोडी बदला