التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 vs GPT-6 Luna

يتقدم Mistral Large 4 في متوسط النتيجة بـ 5.5 مقابل 5.5. لدى GPT-6 Luna تكلفة benchmark أقل عند $0.026 مقابل $0.353. GPT-6 Luna أسرع عند 20.48s مقابل 28.46s، مع معدلات نجاح 30.4% مقابل 40.6%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-06

النماذج المقارنة

الترتيب
#274
إجمالي رموز الإخراج
84,218
زمن الاستجابة (المتوسط)
28.46s
إجمالي التكلفة
$0.353
الترتيب
#279
إجمالي رموز الإخراج
6,855
زمن الاستجابة (المتوسط)
20.48s
إجمالي التكلفة
$0.026
النموذج الموصى به GPT-6 Luna

Its score stays close to the best score here (5.5 vs 5.5), while costing about 13.7x less than Mistral Large 4.

مقارنة تفصيلية

المقياس Mistral Large 4 Mistral Large 4 none الإصدار: 2026-10-06 GPT-6 Luna GPT-6 Luna none الإصدار: 2026-09-23
النتيجة 5.5 5.5
الترتيب #274 #279
الموثوقية 9.9 9.9
الاتساق 8.8 8.2
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 30.4% 40.6%
اختبارات غير مستقرة 4 5
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 7.044 0.367
إجمالي التكلفة $0.353 $0.026
سعر الإدخال $0.680 / 1M $0.100 / 1M
سعر الإخراج $2.090 / 1M $0.500 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.070 / 1M $0.010 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح $0.125 / 1M
إجمالي رموز الإدخال 259,048 222,357
رموز الإخراج 84,218 6,855
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 28.46s 20.48s
زمن الاستجابة (الحد الأقصى) 385.10s 98.62s
زمن الاستجابة (الإجمالي) 654.47s 470.96s
المعلمات 1.05T الإجمالي (49B النشطة) ~400B الإجمالي (~17B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#274 Mistral Large 4

none
التكلفة
$0.004
الوقت
26.7s
الرموز
1,923 tok

#279 GPT-6 Luna

none
التكلفة
$0.002
الوقت
26.0s
الرموز
3,235 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Large 4 5.4 7.8 22.2% 1 153.02s 7,431 62,517 0
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0

مقارنة سريعة

تبديل زوج المقارنة