التنقل
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs xAI: Grok 4.5

يتقدم Qwen3.6 Max Preview (medium) في متوسط النتيجة بـ 8.4 مقابل 8.3. لدى Qwen3.6 Max Preview (medium) تكلفة benchmark أقل عند $1.143 مقابل $1.928. Grok 4.5 (medium) أسرع عند 61.71s مقابل 67.53s، مع معدلات نجاح 80.3% مقابل 78.8%.

النموذج الموصى بهQwen3.6 Max Preview (medium)It has the best score here (8.4), while costing about 1.7x less than Grok 4.5 (medium).

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-25

المقياس Qwen3.6 Max Preview Qwen3.6 Max Preview medium الإصدار: 2026-04-20 Grok 4.5 Grok 4.5 medium الإصدار: 2026-07-08
النتيجة 8.4 8.3
الترتيب #25 #28
الموثوقية 9.9 10.0
الاتساق 8.9 8.9
اختبارات صحيحة
معدل النجاح لكل محاولة 80.3% 78.8%
اختبارات غير مستقرة 3 3
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 8.173 12.049
إجمالي التكلفة $1.143 $1.928
سعر الإدخال $1.040 / 1M $2.000 / 1M
سعر الإخراج $6.240 / 1M $6.000 / 1M
إجمالي رموز الإدخال 79,240 122,146
رموز الإخراج 5,098 5,514
رموز الاستدلال 164,842 275,053
زمن الاستجابة (المتوسط) 67.53s 61.71s
زمن الاستجابة (الحد الأقصى) 238.07s 436.38s
زمن الاستجابة (الإجمالي) 1485.64s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Qwen3.6 Max Preview

medium
التكلفة
$0.024
الوقت
76.5s
الرموز
3,861 tok

#28 xAI: Grok 4.5

medium
التكلفة
$0.044
الوقت
59.4s
الرموز
7,512 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

مقارنة سريعة

تبديل زوج المقارنة