- الترتيب
- #288
- إجمالي رموز الإخراج
- 932,619
- زمن الاستجابة (المتوسط)
- 75.86s
- إجمالي التكلفة
- $0.592
Trinity Large Thinking (high) vs MiniMax M2.5 (medium)
يتقدم Trinity Large Thinking (high) في متوسط النتيجة بـ 4.8 مقابل 4.6. لدى MiniMax M2.5 (medium) تكلفة benchmark أقل عند $0.363 مقابل $0.592. MiniMax M2.5 (medium) أسرع عند 69.08s مقابل 75.86s، مع معدلات نجاح 39.4% مقابل 43.9%.
النماذج المقارنة
- الترتيب
- #300
- إجمالي رموز الإخراج
- 272,229
- زمن الاستجابة (المتوسط)
- 69.08s
- إجمالي التكلفة
- $0.363
النموذج الموصى به
MiniMax M2.5 (medium)
Its score stays close to the best score here (4.6 vs 4.8), while costing about 1.6x less than Trinity Large Thinking (high).
مقارنة تفصيلية
| المقياس | Trinity Large Thinking Trinity Large Thinking high | MiniMax M2.5 MiniMax M2.5 medium |
|---|---|---|
| النتيجة | 4.8 | 4.6 |
| الترتيب | #288 | #300 |
| الموثوقية | 10.0 | 10.0 |
| الاتساق | 7.2 | 6.6 |
| محاولات | 66/66 | 66/66 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 39.4% | 43.9% |
| اختبارات غير مستقرة | 8 | 9 |
| إجمالي مرات التشغيل | 66 | 66 |
| التكلفة لكل نتيجة | 12.473 | 6.463 |
| إجمالي التكلفة | $0.592 | $0.363 |
| سعر الإدخال | $0.250 / 1M | $0.300 / 1M |
| سعر الإخراج | $0.800 / 1M | $1.200 / 1M |
| إجمالي رموز الإدخال | 101,776 | 142,621 |
| رموز الإخراج | 276,367 | 20,409 |
| رموز الاستدلال | 656,252 | 251,820 |
| زمن الاستجابة (المتوسط) | 75.86s | 69.08s |
| زمن الاستجابة (الحد الأقصى) | 510.21s | 251.36s |
| زمن الاستجابة (الإجمالي) | 1668.93s | 1036.24s |
| المعلمات | 398B الإجمالي (13B النشطة) | 230B الإجمالي (10B النشطة) |
| الإتاحة | الأوزان متاحة | الأوزان متاحة |
عرض إنشاء النماذج
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#288 Trinity Large Thinking
high- التكلفة
- $0.028
- الوقت
- 130.1s
- الرموز
- 34,387 tok
#300 MiniMax M2.5
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- التكلفة
- $0.000
- الوقت
- 300.0s
- الرموز
- 0 tok
أفضل النماذج حسب الدرجة
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
| حيل مضادة للذكاء الاصطناعي | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.7 | 8.1 | 58.3% | 1 | 4.13s | 663 | 3,108 | 7,565 | |
| MiniMax M2.5 | 7.9 | 6.3 | 83.3% | 2 | 20.82s | 612 | 286 | 45,344 |
| البرمجة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.7 | 4.7 | 33.3% | 2 | 245.04s | 7,204 | 83,616 | 266,836 | |
| MiniMax M2.5 | 3.4 | 9.1 | 0.0% | 0 | 188.58s | 6,076 | 357 | 106,177 |
| مجمّع | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 262.39s | 76,626 | 14,706 | 149,243 | |
| MiniMax M2.5 | 3.7 | 1.8 | 50.0% | 2 | 83.19s | 119,959 | 16,687 | 18,834 |
| تحليل البيانات واستخراجها | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 13.98s | 6,906 | 580 | 9,338 | |
| MiniMax M2.5 | 4.6 | 1.7 | 66.7% | 2 | 7.48s | 6,584 | 266 | 3,835 |
| خاص بالمجال | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 66.94s | 756 | 163,364 | 166,091 | |
| MiniMax M2.5 | 2.9 | 7.2 | 11.1% | 1 | 158.88s | 368 | 14 | 45,372 |
| الذكاء العام | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.5 | 3.4 | 66.7% | 1 | 12.90s | 501 | 5,700 | 5,942 | |
| MiniMax M2.5 | 3.8 | 2.5 | 33.3% | 1 | 6.63s | 492 | 25 | 1,686 |
| اتباع التعليمات | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 10.0 | 50.0% | 0 | 4.12s | 684 | 88 | 2,853 | |
| MiniMax M2.5 | 7.5 | 10.0 | 50.0% | 0 | 621ms | 699 | 156 | 1,495 |
| حل الألغاز | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.7 | 5.2 | 33.3% | 2 | 3.84s | 678 | 2,566 | 3,368 | |
| MiniMax M2.5 | 5.3 | 7.2 | 44.4% | 1 | 11.21s | 495 | 1,069 | 9,605 |
| استدعاء الأدوات | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.96s | 7,551 | 282 | 1,440 | |
| MiniMax M2.5 | 10.0 | 10.0 | 100.0% | 0 | 15.35s | 7,123 | 269 | 937 |
| معلومات عامة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 125.13s | 207 | 2,357 | 43,576 | |
| MiniMax M2.5 | 3.0 | 10.0 | 0.0% | 0 | 80.79s | 213 | 1,280 | 18,535 |
مقارنة سريعة
تبديل زوج المقارنة
Trinity Large ThinkinghighvsGPT-5.4 NanononeTrinity Large ThinkinghighvsNemotron 3.5 Lightninglowمتاح مجانًاTrinity Large ThinkinghighvsRing-2.6-1TnoneTrinity Large ThinkinghighvsKAT-Coder-Air V2.5noneGranite 4.2 8BhighvsMiniMax M2.5mediumTrinity Large ThinkinghighvsHy4 previewnoneTrinity Large ThinkinghighvsGLM 4.7 FlashnoneMiniMax M2.5mediumvsLaguna S 2.1noneمتاح مجانًاTrinity Large ThinkinghighvsNemotron 3 Supernoneمتاح مجانًاTrinity Large ThinkinghighvsLing-2.6-flashnoneMercury 2nonevsMiniMax M2.5mediumTrinity Large ThinkinghighvsCobuddymedium