नेविगेशन
AI BENCHY
Advertise here

Ling-3.0-flash (high) vs GPT-5.6 Luna (low)

Ling-3.0-flash (high) average score में आगे है: 6.4 vs 6.2. Ling-3.0-flash (high) की benchmark लागत कम है: $0.021 vs $0.051. GPT-5.6 Luna (low) तेज है: 5.20s vs 13.70s, pass rates 63.6% vs 54.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#161
कुल आउटपुट टोकन
299,456
प्रतिक्रिया समय (औसत)
13.70s
कुल लागत
$0.021
रैंक
#167
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
अनुशंसित मॉडल Ling-3.0-flash (high)

It has the best score here (6.4), while costing about 2.5x less than GPT-5.6 Luna (low).

विस्तृत तुलना

मेट्रिक Ling-3.0-flash Ling-3.0-flash high रिलीज़: 2026-07-24 GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09
स्कोर 6.4 6.2
रैंक #161 #167
विश्वसनीयता 9.8 10.0
संगति 8.6 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 54.5%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 0.000 2.437
कुल लागत $0.021 $0.051
इनपुट कीमत $0.021 / 1M $0.200 / 1M
आउटपुट कीमत $0.063 / 1M $1.200 / 1M
कुल इनपुट टोकन 132,044 96,355
आउटपुट टोकन 92,135 8,213
रीजनिंग टोकन 207,321 18,073
प्रतिक्रिया समय (औसत) 13.70s 5.20s
प्रतिक्रिया समय (अधिकतम) 75.27s 19.44s
प्रतिक्रिया समय (कुल) 287.75s 114.46s
पैरामीटर 124B कुल (5.1B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#161 Ling-3.0-flash

high
लागत
$0.000
समय
30.7s
टोकन
10,576 tok

#167 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling-3.0-flash 6.7 5.0 66.7% 2 14.85s 8,298 15,602 32,152
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

त्वरित तुलना

तुलना जोड़ी बदलें