नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.6 Luna vs Poolside: Laguna S 2.1

average score लगभग बराबर है: 5.4 vs 5.4. Laguna S 2.1 (high) की benchmark लागत कम है: $0.127 vs $0.142. GPT-5.6 Luna तेज है: 1.50s vs 111.61s, pass rates 34.9% vs 27.3%.

अनुशंसित मॉडलGPT-5.6 LunaIt has the best score here (5.4), while responding about 74.6x faster than Laguna S 2.1 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-22

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09 Laguna S 2.1 Laguna S 2.1 high रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 5.4 5.4
रैंक #166 #167
विश्वसनीयता 10.0 9.9
संगति 8.8 8.1
सही परीक्षण
प्रति प्रयास पास दर 34.9% 27.3%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 2.360 3.153
कुल लागत $0.142 $0.127
इनपुट कीमत $1.000 / 1M $0.100 / 1M
आउटपुट कीमत $6.000 / 1M $0.200 / 1M
कुल इनपुट टोकन 101,323 208,931
आउटपुट टोकन 6,709 175,588
रीजनिंग टोकन 0 409,276
प्रतिक्रिया समय (औसत) 1.50s 111.61s
प्रतिक्रिया समय (अधिकतम) 10.57s 1190.11s
प्रतिक्रिया समय (कुल) 32.91s 2455.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

#167 Laguna S 2.1

high
लागत
$0.001
समय
6.8s
टोकन
1,389 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009

त्वरित तुलना

तुलना जोड़ी बदलें