नेविगेशन
AI BENCHY
Advertise here

Nemotron 3.5 Lightning (medium) vs GPT-5.6 Luna

GPT-5.6 Luna average score में आगे है: 5.4 vs 5.1. GPT-5.6 Luna की benchmark लागत कम है: $0.029 vs $0.156. GPT-5.6 Luna तेज है: 1.50s vs 70.11s, pass rates 48.5% vs 36.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#234
कुल आउटपुट टोकन
760,441
प्रतिक्रिया समय (औसत)
70.11s
कुल लागत
$0.156
रैंक
#221
कुल आउटपुट टोकन
6,709
प्रतिक्रिया समय (औसत)
1.50s
कुल लागत
$0.029
अनुशंसित मॉडल GPT-5.6 Luna

It has the best score here (5.4), while costing about 5.5x less than Nemotron 3.5 Lightning (medium).

विस्तृत तुलना

मेट्रिक Nemotron 3.5 Lightning Nemotron 3.5 Lightning medium रिलीज़: 2026-08-11 निःशुल्क उपलब्ध GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09
स्कोर 5.1 5.4
रैंक #234 #221
विश्वसनीयता 9.9 10.0
संगति 6.0 8.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 48.5% 36.4%
अस्थिर टेस्ट 11 3
कुल रन 66 66
प्रति परिणाम लागत 0.000 2.357
कुल लागत $0.156 $0.029
इनपुट कीमत $0.080 / 1M $0.200 / 1M
आउटपुट कीमत $0.200 / 1M $1.200 / 1M
कुल इनपुट टोकन 126,330 101,332
आउटपुट टोकन 165,702 6,709
रीजनिंग टोकन 594,739 0
प्रतिक्रिया समय (औसत) 70.11s 1.50s
प्रतिक्रिया समय (अधिकतम) 437.11s 10.57s
प्रतिक्रिया समय (कुल) 1542.52s 33.05s
पैरामीटर 30B कुल (3B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#234 Nemotron 3.5 Lightning

medium
लागत
$0.000
समय
130.5s
टोकन
6,750 tok

#221 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Nemotron 3.5 Lightning 4.4 5.1 33.3% 2 285.47s 7,623 78,065 297,359
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

त्वरित तुलना

तुलना जोड़ी बदलें