नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna Decisions (default) vs Qwen3.5-9B (medium)

Qwen3.5-9B (medium) average score मध्ये पुढे आहे: 4.0 vs 2.4. GPT-6 Luna Decisions (default) चा benchmark खर्च कमी आहे: $0.005 vs $0.106. GPT-6 Luna Decisions (default) वेगवान आहे: 495ms vs 110.18s, pass rates 13.0% vs 26.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#390
एकूण आउटपुट टोकन्स
0
प्रतिसाद वेळ (सरासरी)
495ms
एकूण खर्च
$0.005
क्रमांक
#360
एकूण आउटपुट टोकन्स
447,247
प्रतिसाद वेळ (सरासरी)
110.18s
एकूण खर्च
$0.106
शिफारस केलेले मॉडेल Qwen3.5-9B (medium)

It has the strongest score in this comparison (4.0) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक GPT-6 Luna Decisions GPT-6 Luna Decisions default प्रकाशन: 2026-10-07 Qwen3.5-9B Qwen3.5-9B medium प्रकाशन: 2026-03-02
स्कोअर 2.4 4.0
क्रमांक #390 #360
विश्वसनीयता 10.0 8.7
सुसंगतता 5.2 7.9
प्रयत्न 36/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 13.0% 26.1%
अस्थिर चाचण्या 0 6
एकूण रन 36 69
प्रति निकाल खर्च 0.159 3.523
एकूण खर्च $0.005 $0.106
इनपुट किंमत $0.100 / 1M $0.100 / 1M
आउटपुट किंमत $0.000 / 1M $0.150 / 1M
कॅश वाचण्याची किंमत $0.000 / 1M लागू नाही
कॅश लिहिण्याची किंमत $0.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 47,583 387,323
आउटपुट टोकन्स 0 48,562
रिझनिंग टोकन्स 0 410,431
प्रतिसाद वेळ (सरासरी) 495ms 110.18s
प्रतिसाद वेळ (कमाल) 842ms 569.97s
प्रतिसाद वेळ (एकूण) 5.94s 1873.00s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 9B
उपलब्धता बंद स्रोत मुक्त स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#390 GPT-6 Luna Decisions

default
या मॉडेलसाठी अद्याप कोणताही शोकेस निकाल तयार झालेला नाही.
खर्च
लागू नाही
वेळ
-
टोकन्स
0 tok

#360 Qwen3.5-9B

medium
खर्च
$0.001
वेळ
35.9s
टोकन्स
3,030 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

झटपट तुलना

तुलना जोडी बदला