नेविगेशन
Advertise here

Ling 3.0 Tiny (high) vs Grok 4.20

Grok 4.20 average score में आगे है: 4.1 vs 3.8. Ling 3.0 Tiny (high) की benchmark लागत कम है: $0.000 vs $0.057. Grok 4.20 तेज है: 1.11s vs 75.68s, pass rates 24.2% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-22

तुलना किए गए मॉडल

रैंक
#332
कुल आउटपुट टोकन
950,683
प्रतिक्रिया समय (औसत)
75.68s
कुल लागत
$0.000
रैंक
#323
कुल आउटपुट टोकन
1,923
प्रतिक्रिया समय (औसत)
1.11s
कुल लागत
$0.057
अनुशंसित मॉडल Grok 4.20

It has the best score here (4.1), while responding about 68.2x faster than Ling 3.0 Tiny (high).

विस्तृत तुलना

मेट्रिक Ling 3.0 Tiny Ling 3.0 Tiny high रिलीज़: 2026-08-07 Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31
स्कोर 3.8 4.1
रैंक #332 #323
विश्वसनीयता 10.0 लागू नहीं
संगति 8.8 8.1
प्रयास 66/66 54/66
सही परीक्षण
प्रति प्रयास पास दर 24.2% 27.3%
अस्थिर टेस्ट 3 0
कुल रन 66 54
प्रति परिणाम लागत 0.000 1.570
कुल लागत $0.000 $0.057
इनपुट कीमत $0.000 / 1M $1.250 / 1M
आउटपुट कीमत $0.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 115,314 41,313
आउटपुट टोकन 133,965 1,923
रीजनिंग टोकन 816,718 0
प्रतिक्रिया समय (औसत) 75.68s 1.11s
प्रतिक्रिया समय (अधिकतम) 345.15s 6.04s
प्रतिक्रिया समय (कुल) 1589.20s 19.96s
पैरामीटर 7.9B कुल (1.3B सक्रिय) ~1T कुल (~100B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#332 Ling 3.0 Tiny

high
No output was saved. The original provider response or failure reason is unavailable.
लागत
$0.000
समय
169.5s
टोकन
5,252 tok

#323 xAI: Grok 4.20

none
लागत
$0.004
समय
6.5s
टोकन
1,367 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

त्वरित तुलना

तुलना जोड़ी बदलें