नेविगेशन
AI BENCHY
Advertise here

GPT-5.4 Nano vs Laguna S 2.1 (low)

Laguna S 2.1 (low) average score में आगे है: 5.0 vs 4.8. GPT-5.4 Nano की benchmark लागत कम है: $0.041 vs $0.082. GPT-5.4 Nano तेज है: 2.56s vs 85.34s, pass rates 27.3% vs 22.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#276
कुल आउटपुट टोकन
13,794
प्रतिक्रिया समय (औसत)
2.56s
कुल लागत
$0.041
रैंक
#266
कुल आउटपुट टोकन
451,708
प्रतिक्रिया समय (औसत)
85.34s
कुल लागत
$0.082
अनुशंसित मॉडल GPT-5.4 Nano

Its score stays close to the best score here (4.8 vs 5.0), while costing about 2.0x less than Laguna S 2.1 (low).

विस्तृत तुलना

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano none रिलीज़: 2026-03-17 Laguna S 2.1 Laguna S 2.1 low रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 4.8 5.0
रैंक #276 #266
विश्वसनीयता 10.0 10.0
संगति 8.6 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 27.3% 22.7%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 1.011 3.022
कुल लागत $0.041 $0.082
इनपुट कीमत $0.200 / 1M $0.090 / 1M
आउटपुट कीमत $1.250 / 1M $0.180 / 1M
कुल इनपुट टोकन 115,933 118,752
आउटपुट टोकन 13,794 67,823
रीजनिंग टोकन 0 383,885
प्रतिक्रिया समय (औसत) 2.56s 85.34s
प्रतिक्रिया समय (अधिकतम) 25.50s 814.73s
प्रतिक्रिया समय (कुल) 56.37s 1877.49s
पैरामीटर ~120B कुल (~5B सक्रिय) 118B कुल (8B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#276 GPT-5.4 Nano

none
लागत
$0.008
समय
46.1s
टोकन
5,735 tok

#266 Laguna S 2.1

low
लागत
$0.001
समय
6.6s
टोकन
1,314 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

त्वरित तुलना

तुलना जोड़ी बदलें