नेविगेशन
AI BENCHY
Advertise here

Ling 3.0 Tiny (low) vs Laguna S 2.1

Laguna S 2.1 average score में आगे है: 4.5 vs 3.8. Ling 3.0 Tiny (low) की benchmark लागत कम है: $0.000 vs $0.022. Laguna S 2.1 तेज है: 11.67s vs 66.85s, pass rates 19.7% vs 15.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#241
कुल आउटपुट टोकन
977,836
प्रतिक्रिया समय (औसत)
66.85s
कुल लागत
$0.000
रैंक
#226
कुल आउटपुट टोकन
57,634
प्रतिक्रिया समय (औसत)
11.67s
कुल लागत
$0.022
अनुशंसित मॉडल Laguna S 2.1

It has the best score here (4.5), while responding about 5.7x faster than Ling 3.0 Tiny (low).

विस्तृत तुलना

मेट्रिक Ling 3.0 Tiny Ling 3.0 Tiny low रिलीज़: 2026-08-07 निःशुल्क उपलब्ध Laguna S 2.1 Laguna S 2.1 none रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 3.8 4.5
रैंक #241 #226
विश्वसनीयता 9.7 10.0
संगति 9.7 8.8
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 19.7% 15.2%
अस्थिर टेस्ट 1 3
कुल रन 66 66
प्रति परिणाम लागत 0.000 1.205
कुल लागत $0.000 $0.022
इनपुट कीमत $0.000 / 1M $0.090 / 1M
आउटपुट कीमत $0.000 / 1M $0.180 / 1M
कुल इनपुट टोकन 99,842 125,598
आउटपुट टोकन 152,159 57,634
रीजनिंग टोकन 825,677 0
प्रतिक्रिया समय (औसत) 66.85s 11.67s
प्रतिक्रिया समय (अधिकतम) 252.08s 200.52s
प्रतिक्रिया समय (कुल) 1470.69s 256.80s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#241 Ling 3.0 Tiny

low
अमान्य SVG
लागत
$0.000
समय
200.0s
टोकन
5,030 tok

#226 Laguna S 2.1

none
लागत
$0.001
समय
7.6s
टोकन
1,345 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ling 3.0 Tiny 2.9 10.0 0.0% 0 170.73s 7,619 56,012 170,220
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0

त्वरित तुलना

तुलना जोड़ी बदलें