नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ling 3.1 Flash (medium) vs GPT-6 Luna (medium)

average score जवळपास समान आहे: 8.3 vs 8.3. Ling 3.1 Flash (medium) चा benchmark खर्च कमी आहे: $0.000 vs $0.047. GPT-6 Luna (medium) वेगवान आहे: 18.07s vs 88.74s, pass rates 71.0% vs 73.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-03

तुलना केलेली मॉडेल्स

क्रमांक
#81
एकूण आउटपुट टोकन्स
648,854
प्रतिसाद वेळ (सरासरी)
88.74s
एकूण खर्च
$0.000
क्रमांक
#79
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while responding about 4.9x faster than Ling 3.1 Flash (medium).

तपशीलवार तुलना

मेट्रिक Ling 3.1 Flash Ling 3.1 Flash medium प्रकाशन: 2026-10-03 GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23
स्कोअर 8.3 8.3
क्रमांक #81 #79
विश्वसनीयता 9.6 10.0
सुसंगतता 8.8 8.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.0% 73.9%
अस्थिर चाचण्या 3 3
एकूण रन 69 69
प्रति निकाल खर्च 0.000 0.313
एकूण खर्च $0.000 $0.047
इनपुट किंमत $0.000 / 1M $0.100 / 1M
आउटपुट किंमत $0.000 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत लागू नाही $0.010 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.125 / 1M
एकूण इनपुट टोकन्स 369,495 203,193
आउटपुट टोकन्स 172,852 5,751
रिझनिंग टोकन्स 476,002 47,410
प्रतिसाद वेळ (सरासरी) 88.74s 18.07s
प्रतिसाद वेळ (कमाल) 567.88s 66.44s
प्रतिसाद वेळ (एकूण) 2041.10s 415.53s
पॅरामीटर्स 560B एकूण (25B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 Ling 3.1 Flash

medium
खर्च
$0.000
वेळ
101.1s
टोकन्स
11,607 tok

#79 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Ling 3.1 Flash 10.0 10.0 100.0% 0 87.15s 8,298 19,577 62,002
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

झटपट तुलना

तुलना जोडी बदला