AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#120

GPT-5 Nano

OpenAI रिलीज़: 2025-08-07 परीक्षण किया गया: 2026-07-16 22:32 openai/gpt-5-nano::medium
~120B कुल (~5B सक्रिय)MoEबंद स्रोतअनुमानित

सारांश

GPT-5 Nano AI BENCHY पर 6.1 स्कोर करता है और #120 पर है। इसकी reliability 10.0, pass rate 56.1%, कुल लागत $0.114, और औसत response time 54.87s है।

मॉडल विवरण

शोध की तारीख: 2026-08-12

अनुमानित
पैरामीटर
~120B कुल (~5B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
बंद स्रोत
लाइसेंस
-

सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।

संगति

7.0

कुल आउटपुट टोकन

273,098

कुल इनपुट टोकन

94,935

इनपुट कीमत

$0.050 / 1M

आउटपुट कीमत

$0.400 / 1M

कैश पढ़ने की कीमत

लागू नहीं

कैश लिखने की कीमत

लागू नहीं

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

सही परीक्षण

गलत टेस्ट: 13

प्रति प्रयास पास दर: 56.1%

अस्थिर टेस्ट

8

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

54.87s

प्रतिक्रिया समय (अधिकतम): 227.89s

प्रतिक्रिया समय (कुल): 822.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 GPT-5 Nano

medium
लागत
$0.006
समय
108.5s
टोकन
13,209 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-08-14 02:07 दोबारा परीक्षण 6.0 10.0 $0.118 तुलना करें
2026-07-16 22:32 नया टेस्ट जोड़ा गया 6.1 10.0 $0.114 वर्तमान रन
2026-06-04 13:44 नया टेस्ट जोड़ा गया 6.3 10.0 $0.081 तुलना करें
2026-05-22 00:17 सूट बदला गया 6.1 10.0 $0.076 तुलना करें
2026-04-11 01:44 पहला दर्ज रन 6.3 लागू नहीं $0.066 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

रन तुलना

रनबेंचमार्क कवरेजस्कोरसंगतिविश्वसनीयतासही परीक्षणअस्थिर टेस्टकुल आउटपुट टोकनकुल इनपुट टोकनकुल लागतप्रतिक्रिया समय (औसत)
2026-07-16 22:32 · नया टेस्ट जोड़ा गया66/66 प्रयास6.17.010.09/228273,09894,935$0.11454.87s
2026-06-04 13:44 · नया टेस्ट जोड़ा गया63/63 प्रयास6.37.310.09/217197,52834,108$0.08142.51s
अंतर—-0.2-0.30.00+1+75570+60827+$0.034+12359ms

बेंचमार्क कवरेज अलग है: 66/66 प्रयास (लक्ष्य: प्रति टेस्ट 3 दोहराव) बनाम 63/63 प्रयास (लक्ष्य: प्रति टेस्ट 3 दोहराव)। कुल और दोहराव-संवेदनशील मेट्रिक सीधे तुलना योग्य नहीं हैं।

इन दो रन में अलग-अलग बेंचमार्क सूट इस्तेमाल हुए थे, इसलिए अंतर मॉडल बदलाव और सूट बदलाव दोनों को दर्शाते हैं।

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत कैश पढ़ने की कीमत कैश लिखने की कीमत
2026-06-04 15:40 $0.050 / 1M $0.400 / 1M लागू नहीं लागू नहीं

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 6.5 7.9
कोडिंग 7.0 7.7
संयुक्त 6.4 5.8
डेटा पार्सिंग और निष्कर्षण 3.7 1.7
डोमेन-विशिष्ट 5.2 4.4
Samanya Buddhimatta 4.1 10.0
निर्देश पालन 9.8 10.0
पहेली समाधान 5.3 7.2
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल