नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.6 Max Preview

सारांश

GPT-5.4 Mini vs Qwen3.6 Max Preview benchmark तुलना: Qwen3.6 Max Preview average score में आगे है: 6.0 vs 5.3. GPT-5.4 Mini की benchmark लागत कम है: $0.038 vs $0.075. GPT-5.4 Mini तेज है: 1.13s vs 3.30s, pass rates 30.2% vs 58.7%.

अनुशंसित मॉडल: Qwen3.6 Max Preview - It has the strongest score in this comparison (6.0) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक GPT-5.4 Mini GPT-5.4 Mini none रिलीज़: 2026-03-17 Qwen3.6 Max Preview Qwen3.6 Max Preview none रिलीज़: 2026-04-20
स्कोर 5.3 6.0
रैंक #131 #104
विश्वसनीयता 10.0 10.0
संगति 8.8 9.2
सही परीक्षण
प्रति प्रयास पास दर 30.2% 58.7%
अस्थिर टेस्ट 3 2
कुल रन 63 63
प्रति परिणाम लागत 0.743 0.824
कुल लागत $0.038 $0.075
इनपुट कीमत $0.750 / 1M $1.040 / 1M
आउटपुट कीमत $4.500 / 1M $6.240 / 1M
कुल इनपुट टोकन 34,244 42,509
आउटपुट टोकन 2,541 4,779
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.13s 3.30s
प्रतिक्रिया समय (अधिकतम) 2.52s 20.51s
प्रतिक्रिया समय (कुल) 23.82s 69.40s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#131 GPT-5.4 Mini

none
Cost
$0.010
Time
11.7s
Tokens
2,151 tok

#104 Qwen3.6 Max Preview

none
Cost
$0.025
Time
83.9s
Tokens
4,066 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 3.1 8.1 8.3% 1 929ms 606 654 0
Qwen3.6 Max Preview 5.2 7.9 41.7% 1 2.63s 696 513 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.52s 11,019 298 0
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 20.51s 14,949 2,842 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 10.0 10.0 100.0% 0 1.30s 7,140 222 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.87s 7,794 243 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 3.5 4.4 33.3% 2 937ms 723 88 0
Qwen3.6 Max Preview 7.7 10.0 66.7% 0 1.22s 789 18 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 4.8 10.0 0.0% 0 1.82s 477 174 0
Qwen3.6 Max Preview 4.3 10.0 0.0% 0 1.62s 522 76 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 6.3 10.0 50.0% 0 728ms 660 101 0
Qwen3.6 Max Preview 9.8 10.0 100.0% 0 1.40s 711 69 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 5.4 10.0 33.3% 0 836ms 642 305 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.65s 714 321 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.32s 5,477 255 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 5.27s 8,211 222 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 3.0 10.0 0.0% 0 1.33s 195 43 0
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 1.97s 210 19 0

त्वरित तुलना

तुलना जोड़ी बदलें