नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

OpenAI: GPT-5.4 Nano vs Qwen: Qwen3.5-9B

सारांश

GPT-5.4 Nano vs Qwen3.5-9B benchmark तुलना: GPT-5.4 Nano average score में आगे है: 4.8 vs 3.8. GPT-5.4 Nano की benchmark लागत कम है: $0.011 vs $0.036. GPT-5.4 Nano तेज है: 1.48s vs 82.24s, pass rates 30.2% vs 27.0%.

अनुशंसित मॉडल: GPT-5.4 Nano - It has the best score here (4.8), while costing about 3.5x less than Qwen3.5-9B.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano none रिलीज़: 2026-03-17 Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02
स्कोर 4.8 3.8
रैंक #149 #164
विश्वसनीयता 10.0 6.7
संगति 8.2 8.0
सही परीक्षण
प्रति प्रयास पास दर 30.2% 27.0%
अस्थिर टेस्ट 5 5
कुल रन 63 63
प्रति परिणाम लागत 0.259 1.187
कुल लागत $0.011 $0.036
इनपुट कीमत $0.200 / 1M $0.100 / 1M
आउटपुट कीमत $1.250 / 1M $0.150 / 1M
कुल इनपुट टोकन 34,212 17,070
आउटपुट टोकन 2,784 29,045
रीजनिंग टोकन 0 209,516
प्रतिक्रिया समय (औसत) 1.48s 82.24s
प्रतिक्रिया समय (अधिकतम) 4.47s 226.38s
प्रतिक्रिया समय (कुल) 31.01s 1315.88s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#149 GPT-5.4 Nano

none
Cost
$0.008
Time
46.1s
Tokens
5,735 tok

#164 Qwen3.5-9B

medium
Cost
$0.001
Time
35.9s
Tokens
3,030 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 606 800 0
Qwen3.5-9B 5.1 5.8 50.0% 2 34.44s 369 2,621 12,411
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 11,019 280 0
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 7,140 219 0
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 4,722 1,383 32,113
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 723 52 0
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 295 11,549 48,475
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 477 180 0
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 180 0 30,695
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 6.3 10.0 50.0% 0 784ms 660 89 0
Qwen3.5-9B 6.5 10.0 50.0% 0 5.75s 381 491 1,824
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 5.4 10.0 33.3% 0 1.25s 642 308 0
Qwen3.5-9B 3.0 10.0 0.0% 0 32.27s 376 1,593 12,026
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 5,445 222 0
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 8,283 444 1,149
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 3.0 10.0 0.0% 0 773ms 195 21 0
Qwen3.5-9B 3.0 10.0 0.0% 0 177.02s 68 3,074 29,694

त्वरित तुलना

तुलना जोड़ी बदलें