التنقل
Advertise here

GPT-5.2 Chat (default) vs Step 5 Preview (high)

يتقدم GPT-5.2 Chat (default) في متوسط النتيجة بـ 7.0 مقابل 7.0. لدى GPT-5.2 Chat (default) تكلفة benchmark أقل عند $0.594 مقابل $4.513. GPT-5.2 Chat (default) أسرع عند 7.43s مقابل 154.41s، مع معدلات نجاح 66.7% مقابل 52.2%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-09

النماذج المقارنة

الترتيب
#164
إجمالي رموز الإخراج
29,742
زمن الاستجابة (المتوسط)
7.43s
إجمالي التكلفة
$0.594
الترتيب
#169
إجمالي رموز الإخراج
1,581,325
زمن الاستجابة (المتوسط)
154.41s
إجمالي التكلفة
$4.513
النموذج الموصى به GPT-5.2 Chat (default)

It has the best score here (7.0), while costing about 7.6x less than Step 5 Preview (high).

مقارنة تفصيلية

المقياس GPT-5.2 Chat GPT-5.2 Chat default الإصدار: 2025-12-11 Step 5 Preview Step 5 Preview high الإصدار: 2026-10-09
النتيجة 7.0 7.0
الترتيب #164 #169
الموثوقية 10.0 9.5
الاتساق 8.7 8.5
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 66.7% 52.2%
اختبارات غير مستقرة 4 4
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 4.564 45.130
إجمالي التكلفة $0.594 $4.513
سعر الإدخال $1.750 / 1M $1.000 / 1M
سعر الإخراج $14.000 / 1M $2.700 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.175 / 1M $0.050 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 101,104 243,381
رموز الإخراج 10,414 1,581,325
رموز الاستدلال 19,328 0
زمن الاستجابة (المتوسط) 7.43s 154.41s
زمن الاستجابة (الحد الأقصى) 38.52s 455.72s
زمن الاستجابة (الإجمالي) 163.35s 3551.40s
المعلمات ~400B الإجمالي (~17B النشطة) 600B الإجمالي (27B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 GPT-5.2 Chat

default
التكلفة
$0.010
الوقت
15.3s
الرموز
797 tok

#169 Step 5 Preview

high
التكلفة
$0.057
الوقت
150.1s
الرموز
20,970 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 843 5,888
Step 5 Preview 2.9 10.0 0.0% 0 421.68s 7,383 576,000 0

تبديل زوج المقارنة