नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs Ling 3.0 Tiny

Trinity Large Thinking (high) average score मध्ये पुढे आहे: 4.8 vs 4.0. Ling 3.0 Tiny चा benchmark खर्च कमी आहे: $0.000 vs $0.632. Ling 3.0 Tiny वेगवान आहे: 13.42s vs 77.22s, pass rates 39.4% vs 9.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-07

क्रमांक
#215
एकूण आउटपुट टोकन्स
953,758
प्रतिसाद वेळ (सरासरी)
77.22s
एकूण खर्च
$0.632
क्रमांक
#237
एकूण आउटपुट टोकन्स
110,077
प्रतिसाद वेळ (सरासरी)
13.42s
एकूण खर्च
$0.000
शिफारस केलेले मॉडेल Trinity Large Thinking (high)

It has the strongest score in this comparison (4.8) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high प्रकाशन: 2026-07-28 Ling 3.0 Tiny Ling 3.0 Tiny none प्रकाशन: 2026-08-07 मोफत उपलब्ध
स्कोअर 4.8 4.0
क्रमांक #215 #237
विश्वसनीयता 9.9 9.8
सुसंगतता 7.2 10.0
बेंचमार्क कव्हरेज 22/22 चाचण्या · 66/66 प्रयत्न 22/22 चाचण्या · 66/66 प्रयत्न
बरोबर चाचण्या
प्रति प्रयत्न पास दर 39.4% 9.1%
अस्थिर चाचण्या 8 0
एकूण रन 66 66
प्रति निकाल खर्च 12.640 0.000
एकूण खर्च $0.632 $0.000
इनपुट किंमत $0.220 / 1M $0.000 / 1M
आउटपुट किंमत $0.850 / 1M $0.000 / 1M
एकूण इनपुट टोकन्स 101,767 184,762
आउटपुट टोकन्स 286,218 110,077
रिझनिंग टोकन्स 667,540 0
प्रतिसाद वेळ (सरासरी) 77.22s 13.42s
प्रतिसाद वेळ (कमाल) 510.21s 240.61s
प्रतिसाद वेळ (एकूण) 1698.89s 295.29s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#215 Trinity Large Thinking

high
खर्च
$0.028
वेळ
130.1s
टोकन्स
34,387 tok

#237 Ling 3.0 Tiny

none
अवैध SVG
खर्च
$0.000
वेळ
334.1s
टोकन्स
32,913 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Ling 3.0 Tiny 4.2 10.0 0.0% 0 1.19s 8,307 798 0

झटपट तुलना

तुलना जोडी बदला