नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna (low) vs Qwen3.7 Flash

GPT-5.6 Luna (low) average score मध्ये पुढे आहे: 6.2 vs 6.1. Qwen3.7 Flash चा benchmark खर्च कमी आहे: $0.019 vs $0.125. GPT-5.6 Luna (low) वेगवान आहे: 5.04s vs 10.06s, pass rates 56.1% vs 36.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#131
एकूण आउटपुट टोकन्स
25,438
प्रतिसाद वेळ (सरासरी)
5.04s
एकूण खर्च
$0.125
क्रमांक
#136
एकूण आउटपुट टोकन्स
90,507
प्रतिसाद वेळ (सरासरी)
10.06s
एकूण खर्च
$0.019
शिफारस केलेले मॉडेल Qwen3.7 Flash

Its score stays close to the best score here (6.1 vs 6.2), while costing about 6.8x less than GPT-5.6 Luna (low).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna low प्रकाशन: 2026-07-09 Qwen3.7 Flash Qwen3.7 Flash none प्रकाशन: 2026-07-28
स्कोअर 6.2 6.1
क्रमांक #131 #136
विश्वसनीयता 10.0 10.0
सुसंगतता 8.2 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 56.1% 36.4%
अस्थिर चाचण्या 5 2
एकूण रन 66 66
प्रति निकाल खर्च 2.490 0.262
एकूण खर्च $0.125 $0.019
इनपुट किंमत $0.500 / 1M $0.030 / 1M
आउटपुट किंमत $3.000 / 1M $0.130 / 1M
एकूण इनपुट टोकन्स 96,346 218,731
आउटपुट टोकन्स 8,211 90,507
रिझनिंग टोकन्स 17,227 0
प्रतिसाद वेळ (सरासरी) 5.04s 10.06s
प्रतिसाद वेळ (कमाल) 19.44s 186.24s
प्रतिसाद वेळ (एकूण) 110.88s 221.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#131 GPT-5.6 Luna

low
खर्च
$0.011
वेळ
10.2s
टोकन्स
1,897 tok

#136 Qwen3.7 Flash

none
खर्च
$0.001
वेळ
34.0s
टोकन्स
4,814 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
Qwen3.7 Flash 5.5 10.0 33.3% 0 1.55s 7,911 855 0

झटपट तुलना

तुलना जोडी बदला