नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna (high) vs Qwen3.7 Flash (high)

Qwen3.7 Flash (high) average score मध्ये पुढे आहे: 7.8 vs 7.7. Qwen3.7 Flash (high) चा benchmark खर्च कमी आहे: $0.051 vs $0.509. GPT-5.6 Luna (high) वेगवान आहे: 18.68s vs 39.77s, pass rates 72.7% vs 72.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#52
एकूण आउटपुट टोकन्स
155,998
प्रतिसाद वेळ (सरासरी)
18.68s
एकूण खर्च
$0.509
क्रमांक
#48
एकूण आउटपुट टोकन्स
359,703
प्रतिसाद वेळ (सरासरी)
39.77s
एकूण खर्च
$0.051
शिफारस केलेले मॉडेल Qwen3.7 Flash (high)

It has the best score here (7.8), while costing about 10.1x less than GPT-5.6 Luna (high).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna high प्रकाशन: 2026-07-09 Qwen3.7 Flash Qwen3.7 Flash high प्रकाशन: 2026-07-28
स्कोअर 7.7 7.8
क्रमांक #52 #48
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 7.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 72.7% 72.7%
अस्थिर चाचण्या 3 6
एकूण रन 66 66
प्रति निकाल खर्च 6.780 0.387
एकूण खर्च $0.509 $0.051
इनपुट किंमत $0.500 / 1M $0.030 / 1M
आउटपुट किंमत $3.000 / 1M $0.130 / 1M
एकूण इनपुट टोकन्स 80,918 116,322
आउटपुट टोकन्स 5,088 12,332
रिझनिंग टोकन्स 150,910 347,371
प्रतिसाद वेळ (सरासरी) 18.68s 39.77s
प्रतिसाद वेळ (कमाल) 111.09s 431.47s
प्रतिसाद वेळ (एकूण) 411.05s 875.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#52 GPT-5.6 Luna

high
खर्च
$0.033
वेळ
34.2s
टोकन्स
5,484 tok

#48 Qwen3.7 Flash

high
अवैध SVG
खर्च
$0.000
वेळ
600.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
Qwen3.7 Flash 8.2 9.7 66.7% 0 58.84s 7,893 503 62,350

झटपट तुलना

तुलना जोडी बदला