التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs Ling 3.0 Tiny

يتقدم Trinity Large Thinking (high) في متوسط النتيجة بـ 4.8 مقابل 4.0. لدى Ling 3.0 Tiny تكلفة benchmark أقل عند $0.000 مقابل $0.592. Ling 3.0 Tiny أسرع عند 14.02s مقابل 75.86s، مع معدلات نجاح 39.4% مقابل 9.1%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-09-23

النماذج المقارنة

الترتيب
#313
إجمالي رموز الإخراج
932,619
زمن الاستجابة (المتوسط)
75.86s
إجمالي التكلفة
$0.592
الترتيب
#338
إجمالي رموز الإخراج
110,071
زمن الاستجابة (المتوسط)
14.02s
إجمالي التكلفة
$0.000
النموذج الموصى به Trinity Large Thinking (high)

It has the strongest score in this comparison (4.8) and the best overall balance of cost and response time across all 2 models.

مقارنة تفصيلية

المقياس Trinity Large Thinking Trinity Large Thinking high الإصدار: 2026-07-28 Ling 3.0 Tiny Ling 3.0 Tiny none الإصدار: 2026-08-07
النتيجة 4.8 4.0
الترتيب #313 #338
الموثوقية 10.0 9.8
الاتساق 7.2 10.0
محاولات 66/66 66/66
اختبارات صحيحة
معدل النجاح لكل محاولة 39.4% 9.1%
اختبارات غير مستقرة 8 0
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 12.473 0.000
إجمالي التكلفة $0.592 $0.000
سعر الإدخال $0.250 / 1M $0.000 / 1M
سعر الإخراج $0.800 / 1M $0.000 / 1M
إجمالي رموز الإدخال 101,776 184,579
رموز الإخراج 276,367 110,071
رموز الاستدلال 656,252 0
زمن الاستجابة (المتوسط) 75.86s 14.02s
زمن الاستجابة (الحد الأقصى) 510.21s 240.61s
زمن الاستجابة (الإجمالي) 1668.93s 294.46s
المعلمات 398B الإجمالي (13B النشطة) 7.9B الإجمالي (1.3B النشطة)
الإتاحة الأوزان متاحة مفتوح المصدر

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#313 Trinity Large Thinking

high
التكلفة
$0.028
الوقت
130.1s
الرموز
34,387 tok

#338 Ling 3.0 Tiny

none
No output was saved. The original provider response or failure reason is unavailable.
التكلفة
$0.000
الوقت
334.1s
الرموز
32,913 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Ling 3.0 Tiny 4.2 10.0 0.0% 0 1.19s 8,307 798 0

مقارنة سريعة

تبديل زوج المقارنة