नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6.1 Sol (low) vs Qwen3.7 Max (medium)

GPT-6.1 Sol (low) average score में आगे है: 9.6 vs 8.5. GPT-6.1 Sol (low) की benchmark लागत कम है: $0.460 vs $1.689. GPT-6.1 Sol (low) तेज है: 7.15s vs 48.35s, pass rates 92.8% vs 85.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-03

तुलना किए गए मॉडल

रैंक
#16
कुल आउटपुट टोकन
13,138
प्रतिक्रिया समय (औसत)
7.15s
कुल लागत
$0.460
रैंक
#67
कुल आउटपुट टोकन
259,032
प्रतिक्रिया समय (औसत)
48.35s
कुल लागत
$1.689
अनुशंसित मॉडल GPT-6.1 Sol (low)

It has the best score here (9.6), while costing about 3.7x less than Qwen3.7 Max (medium).

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol low रिलीज़: 2026-09-29 Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22
स्कोर 9.6 8.5
रैंक #16 #67
विश्वसनीयता 10.0 10.0
संगति 9.6 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 92.8% 85.5%
अस्थिर टेस्ट 1 4
कुल रन 69 69
प्रति परिणाम लागत 2.187 12.033
कुल लागत $0.460 $1.689
इनपुट कीमत $2.000 / 1M $1.475 / 1M
आउटपुट कीमत $10.000 / 1M $4.425 / 1M
कैश पढ़ने की कीमत $0.100 / 1M $0.295 / 1M
कैश लिखने की कीमत $2.500 / 1M $1.844 / 1M
कुल इनपुट टोकन 163,900 367,848
आउटपुट टोकन 4,958 8,753
रीजनिंग टोकन 8,180 250,279
प्रतिक्रिया समय (औसत) 7.15s 48.35s
प्रतिक्रिया समय (अधिकतम) 46.57s 556.06s
प्रतिक्रिया समय (कुल) 164.47s 1112.11s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#16 GPT-6.1 Sol

low
लागत
$0.028
समय
44.6s
टोकन
2,881 tok

#67 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808

त्वरित तुलना

तुलना जोड़ी बदलें