नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.6 Luna vs Poolside: Laguna S 2.1

average score जवळपास समान आहे: 5.4 vs 5.4. Laguna S 2.1 (medium) चा benchmark खर्च कमी आहे: $0.059 vs $0.142. GPT-5.6 Luna वेगवान आहे: 1.50s vs 58.43s, pass rates 34.9% vs 25.8%.

शिफारस केलेले मॉडेलGPT-5.6 LunaIt has the best score here (5.4), while responding about 39.1x faster than Laguna S 2.1 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none प्रकाशन: 2026-07-09 Laguna S 2.1 Laguna S 2.1 medium प्रकाशन: 2026-07-21 मोफत उपलब्ध
स्कोअर 5.4 5.4
क्रमांक #166 #164
विश्वसनीयता 10.0 9.8
सुसंगतता 8.8 8.4
बरोबर चाचण्या
प्रति प्रयत्न पास दर 34.9% 25.8%
अस्थिर चाचण्या 3 4
एकूण रन 66 66
प्रति निकाल खर्च 2.360 1.451
एकूण खर्च $0.142 $0.059
इनपुट किंमत $1.000 / 1M $0.100 / 1M
आउटपुट किंमत $6.000 / 1M $0.200 / 1M
एकूण इनपुट टोकन्स 101,323 86,641
आउटपुट टोकन्स 6,709 97,298
रिझनिंग टोकन्स 0 242,297
प्रतिसाद वेळ (सरासरी) 1.50s 58.43s
प्रतिसाद वेळ (कमाल) 10.57s 560.31s
प्रतिसाद वेळ (एकूण) 32.91s 1285.48s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 GPT-5.6 Luna

none
खर्च
$0.016
वेळ
15.8s
टोकन्स
2,685 tok

#164 Laguna S 2.1

medium
खर्च
$0.001
वेळ
4.0s
टोकन्स
867 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718

झटपट तुलना

तुलना जोडी बदला