التنقل
Advertise here

Ling 3.0 Tiny (medium) vs Decider V1.1 27B (default)

يتقدم Ling 3.0 Tiny (medium) في متوسط النتيجة بـ 3.6 مقابل 2.6. لدى Ling 3.0 Tiny (medium) تكلفة benchmark أقل عند $0.000 مقابل $0.002. Decider V1.1 27B (default) أسرع عند 320ms مقابل 64.99s، مع معدلات نجاح 23.2% مقابل 17.4%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-07

النماذج المقارنة

الترتيب
#375
إجمالي رموز الإخراج
911,748
زمن الاستجابة (المتوسط)
64.99s
إجمالي التكلفة
$0.000
الترتيب
#395
إجمالي رموز الإخراج
69
زمن الاستجابة (المتوسط)
320ms
إجمالي التكلفة
$0.002
النموذج الموصى به Ling 3.0 Tiny (medium)

يحقق أعلى نتيجة في هذه المقارنة (3.6) وأفضل توازن عام بين التكلفة وزمن الاستجابة بين النماذج المقارَنة (2).

مقارنة تفصيلية

المقياس Ling 3.0 Tiny Ling 3.0 Tiny medium الإصدار: 2026-08-07 Decider V1.1 27B Decider V1.1 27B default الإصدار: 2026-10-07
النتيجة 3.6 2.6
الترتيب #375 #395
الموثوقية 9.6 10.0
الاتساق 8.9 5.2
محاولات 69/69 36/69
اختبارات صحيحة
معدل النجاح لكل محاولة 23.2% 17.4%
اختبارات غير مستقرة 3 0
إجمالي مرات التشغيل 69 36
التكلفة لكل نتيجة 0.000 0.037
إجمالي التكلفة $0.000 $0.002
سعر الإدخال $0.000 / 1M $0.020 / 1M
سعر الإخراج $0.000 / 1M $0.000 / 1M
سعر قراءة ذاكرة التخزين المؤقت غير متاح غير متاح
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 103,898 73,557
رموز الإخراج 148,304 69
رموز الاستدلال 774,972 0
زمن الاستجابة (المتوسط) 64.99s 320ms
زمن الاستجابة (الحد الأقصى) 262.20s 491ms
زمن الاستجابة (الإجمالي) 1429.68s 3.84s
المعلمات 7.9B الإجمالي (1.3B النشطة) 27B
الإتاحة مفتوح المصدر مفتوح المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#375 Ling 3.0 Tiny

medium
No output was saved. The original provider response or failure reason is unavailable.
التكلفة
$0.000
الوقت
177.4s
الرموز
6,873 tok

#395 Decider V1.1 27B

default
لم يتم إنشاء نتيجة عرض لهذا النموذج بعد.
التكلفة
غير متاح
الوقت
-
الرموز
0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

تبديل زوج المقارنة

Ling 3.0 TinymediumvsNemotron 3.5 Lightningnoneمتاح مجانًاGranite 4.1 8bdefaultvsLing 3.0 TinymediumLing 3.0 TinymediumvsGrok 4.20noneCommand A+lowvsDecider V1.1 27BdefaultCommand A+nonevsDecider V1.1 27BdefaultMercury 2.5nonevsLing 3.0 TinymediumCommand A+highvsLing 3.0 TinymediumLing 3.0 Tinymediumvsgpt-oss-120bnoneCommand A+highvsDecider V1.1 27BdefaultCommand A+nonevsLing 3.0 TinymediumCommand A+lowvsLing 3.0 TinymediumMercury 2nonevsLing 3.0 Tinymedium