नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.6 Luna vs Poolside: Laguna S 2.1

average score लगभग बराबर है: 5.4 vs 5.4. Laguna S 2.1 (medium) की benchmark लागत कम है: $0.059 vs $0.142. GPT-5.6 Luna तेज है: 1.50s vs 58.43s, pass rates 34.9% vs 25.8%.

अनुशंसित मॉडलGPT-5.6 LunaIt has the best score here (5.4), while responding about 39.1x faster than Laguna S 2.1 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09 Laguna S 2.1 Laguna S 2.1 medium रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.4 5.4
रैंक #166 #164
विश्वसनीयता 10.0 9.8
संगति 8.8 8.4
सही परीक्षण
प्रति प्रयास पास दर 34.9% 25.8%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 2.360 1.451
कुल लागत $0.142 $0.059
इनपुट कीमत $1.000 / 1M $0.100 / 1M
आउटपुट कीमत $6.000 / 1M $0.200 / 1M
कुल इनपुट टोकन 101,323 86,641
आउटपुट टोकन 6,709 97,298
रीजनिंग टोकन 0 242,297
प्रतिक्रिया समय (औसत) 1.50s 58.43s
प्रतिक्रिया समय (अधिकतम) 10.57s 560.31s
प्रतिक्रिया समय (कुल) 32.91s 1285.48s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

#164 Laguna S 2.1

medium
लागत
$0.001
समय
4.0s
टोकन
867 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718

त्वरित तुलना

तुलना जोड़ी बदलें