التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 (medium) vs Grok 4.6 (high)

يتقدم GPT-5.2 (medium) في متوسط النتيجة بـ 8.7 مقابل 8.5. لدى GPT-5.2 (medium) تكلفة benchmark أقل عند $1.558 مقابل $2.629. GPT-5.2 (medium) أسرع عند 31.29s مقابل 87.48s، مع معدلات نجاح 73.9% مقابل 82.6%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-02

النماذج المقارنة

الترتيب
#54
إجمالي رموز الإخراج
80,538
زمن الاستجابة (المتوسط)
31.29s
إجمالي التكلفة
$1.558
الترتيب
#64
إجمالي رموز الإخراج
312,614
زمن الاستجابة (المتوسط)
87.48s
إجمالي التكلفة
$2.629
النموذج الموصى به GPT-5.2 (medium)

It has the best score here (8.7), while costing about 1.7x less than Grok 4.6 (high).

مقارنة تفصيلية

المقياس GPT-5.2 GPT-5.2 medium الإصدار: 2025-12-11 Grok 4.6 Grok 4.6 high الإصدار: 2026-08-12
النتيجة 8.7 8.5
الترتيب #54 #64
الموثوقية 10.0 10.0
الاتساق 8.5 10.0
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 73.9% 82.6%
اختبارات غير مستقرة 4 0
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 10.261 13.833
إجمالي التكلفة $1.558 $2.629
سعر الإدخال $1.750 / 1M $2.000 / 1M
سعر الإخراج $14.000 / 1M $6.000 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.175 / 1M $0.500 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 235,207 376,233
رموز الإخراج 11,065 6,687
رموز الاستدلال 69,473 305,927
زمن الاستجابة (المتوسط) 31.29s 87.48s
زمن الاستجابة (الحد الأقصى) 116.86s 618.49s
زمن الاستجابة (الإجمالي) 531.98s 2012.15s
المعلمات ~1.2T الإجمالي (~80B النشطة) ~1.7T الإجمالي (~170B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#54 GPT-5.2

medium
التكلفة
$0.047
الوقت
49.2s
الرموز
3,396 tok

#64 SpaceXAI: Grok 4.6

high
التكلفة
$0.107
الوقت
265.1s
الرموز
18,001 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829

مقارنة سريعة

تبديل زوج المقارنة