नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.7 Flash (low) vs Grok 4.5 (low)

Grok 4.5 (low) average score में आगे है: 7.8 vs 7.7. Qwen3.7 Flash (low) की benchmark लागत कम है: $0.071 vs $1.345. Grok 4.5 (low) तेज है: 18.14s vs 41.03s, pass rates 68.1% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-06

तुलना किए गए मॉडल

रैंक
#117
कुल आउटपुट टोकन
331,107
प्रतिक्रिया समय (औसत)
41.03s
कुल लागत
$0.071
रैंक
#112
कुल आउटपुट टोकन
121,415
प्रतिक्रिया समय (औसत)
18.14s
कुल लागत
$1.345
अनुशंसित मॉडल Qwen3.7 Flash (low)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 19.1x less than Grok 4.5 (low).

विस्तृत तुलना

मेट्रिक Qwen3.7 Flash Qwen3.7 Flash low रिलीज़: 2026-07-28 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 7.7 7.8
रैंक #117 #112
विश्वसनीयता 10.0 10.0
संगति 8.1 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 68.1% 73.9%
अस्थिर टेस्ट 6 2
कुल रन 69 69
प्रति परिणाम लागत 0.439 8.404
कुल लागत $0.071 $1.345
इनपुट कीमत $0.030 / 1M $2.000 / 1M
आउटपुट कीमत $0.130 / 1M $6.000 / 1M
कैश पढ़ने की कीमत $0.006 / 1M $0.300 / 1M
कैश लिखने की कीमत $0.039 / 1M लागू नहीं
कुल इनपुट टोकन 318,058 308,068
आउटपुट टोकन 16,035 9,218
रीजनिंग टोकन 315,072 112,197
प्रतिक्रिया समय (औसत) 41.03s 18.14s
प्रतिक्रिया समय (अधिकतम) 394.54s 205.28s
प्रतिक्रिया समय (कुल) 943.75s 417.21s
पैरामीटर ~35B कुल (~3B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 Qwen3.7 Flash

low
Reached the allocated time limit (600 seconds) without receiving showcase output.
लागत
$0.000
समय
600.0s
टोकन
0 tok

#112 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Flash 6.7 7.8 55.6% 1 42.36s 7,893 428 56,419
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें