- الترتيب
- #266
- إجمالي رموز الإخراج
- 932,619
- زمن الاستجابة (المتوسط)
- 75.86s
- إجمالي التكلفة
- $0.592
Trinity Large Thinking (high) vs Granite 4.2 8B
يتقدم Trinity Large Thinking (high) في متوسط النتيجة بـ 4.8 مقابل 4.3. لدى Granite 4.2 8B تكلفة benchmark أقل عند $0.026 مقابل $0.592. Trinity Large Thinking (high) أسرع عند 75.86s مقابل 86.27s، مع معدلات نجاح 39.4% مقابل 16.7%.
- الترتيب
- #285
- إجمالي رموز الإخراج
- 130,805
- زمن الاستجابة (المتوسط)
- 86.27s
- إجمالي التكلفة
- $0.026
النموذج الموصى به
Granite 4.2 8B
Its score stays close to the best score here (4.3 vs 4.8), while costing about 23.3x less than Trinity Large Thinking (high).
مقارنة تفصيلية
| المقياس | Trinity Large Thinking Trinity Large Thinking high | Granite 4.2 8B Granite 4.2 8B none |
|---|---|---|
| النتيجة | 4.8 | 4.3 |
| الترتيب | #266 | #285 |
| الموثوقية | 10.0 | 8.6 |
| الاتساق | 7.2 | 9.3 |
| محاولات | 66/66 | 66/66 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 39.4% | 16.7% |
| اختبارات غير مستقرة | 8 | 2 |
| إجمالي مرات التشغيل | 66 | 66 |
| التكلفة لكل نتيجة | 12.473 | 0.847 |
| إجمالي التكلفة | $0.592 | $0.026 |
| سعر الإدخال | $0.250 / 1M | $0.100 / 1M |
| سعر الإخراج | $0.800 / 1M | $0.150 / 1M |
| إجمالي رموز الإدخال | 101,776 | 57,786 |
| رموز الإخراج | 276,367 | 130,805 |
| رموز الاستدلال | 656,252 | 0 |
| زمن الاستجابة (المتوسط) | 75.86s | 86.27s |
| زمن الاستجابة (الحد الأقصى) | 510.21s | 747.17s |
| زمن الاستجابة (الإجمالي) | 1668.93s | 1897.96s |
| المعلمات | 398B الإجمالي (13B النشطة) | 8B |
| الإتاحة | الأوزان متاحة | مفتوح المصدر |
عرض إنشاء النماذج
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#266 Trinity Large Thinking
high- التكلفة
- $0.028
- الوقت
- 130.1s
- الرموز
- 34,387 tok
#285 IBM: Granite 4.2 8B
none
Provider returned error
- التكلفة
- $0.000
- الوقت
- 0.2s
- الرموز
- 0 tok
أفضل النماذج حسب الدرجة
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
| حيل مضادة للذكاء الاصطناعي | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.7 | 8.1 | 58.3% | 1 | 4.13s | 663 | 3,108 | 7,565 | |
| Granite 4.2 8B | 4.9 | 8.1 | 33.3% | 1 | 17.77s | 669 | 6,026 | 0 |
| البرمجة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.7 | 4.7 | 33.3% | 2 | 245.04s | 7,204 | 83,616 | 266,836 | |
| Granite 4.2 8B | 5.5 | 10.0 | 33.3% | 0 | 105.60s | 8,358 | 47,944 | 0 |
| مجمّع | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 262.39s | 76,626 | 14,706 | 149,243 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 424.28s | 30,500 | 29,755 | 0 |
| تحليل البيانات واستخراجها | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 13.98s | 6,906 | 580 | 9,338 | |
| Granite 4.2 8B | 2.9 | 5.8 | 16.7% | 1 | 1.05s | 7,629 | 237 | 0 |
| خاص بالمجال | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 66.94s | 756 | 163,364 | 166,091 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 53.62s | 696 | 38,145 | 0 |
| الذكاء العام | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.5 | 3.4 | 66.7% | 1 | 12.90s | 501 | 5,700 | 5,942 | |
| Granite 4.2 8B | 5.0 | 10.0 | 0.0% | 0 | 770ms | 534 | 153 | 0 |
| اتباع التعليمات | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 10.0 | 50.0% | 0 | 4.12s | 684 | 88 | 2,853 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 79.50s | 375 | 1,275 | 0 |
| حل الألغاز | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.7 | 5.2 | 33.3% | 2 | 3.84s | 678 | 2,566 | 3,368 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 107.60s | 472 | 6,964 | 0 |
| استدعاء الأدوات | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.96s | 7,551 | 282 | 1,440 | |
| Granite 4.2 8B | 10.0 | 10.0 | 100.0% | 0 | 1.39s | 8,331 | 291 | 0 |
| معلومات عامة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 125.13s | 207 | 2,357 | 43,576 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 14.60s | 222 | 15 | 0 |
مقارنة سريعة
تبديل زوج المقارنة
Trinity Large ThinkinghighvsGPT-5.4 NanononeGranite 4.2 8BnonevsGLM 4.7 FlashmediumTrinity Large ThinkinghighvsNemotron 3.5 Lightninglowمتاح مجانًاTrinity Large ThinkinghighvsRing-2.6-1TnoneTrinity Large ThinkinghighvsKAT-Coder-Air V2.5noneTrinity Large ThinkinghighvsHy4 previewnoneTrinity Large ThinkinghighvsGLM 4.7 FlashnoneTrinity Large ThinkinghighvsNemotron 3 Supernoneمتاح مجانًاTrinity Large ThinkinghighvsLing-2.6-flashnoneTrinity Large ThinkinghighvsCobuddymediumTrinity Large ThinkinghighvsMercury 2.5 PreviewnoneTrinity Large ThinkinghighvsMercury 2none