#22 GPT-5.2 Chat
none- التكلفة
- $0.010
- الوقت
- 15.3s
- الرموز
- 797 tok
AI BENCHY Compare
الملخص
يتقدم Qwen3.7 Max (medium) في متوسط النتيجة بـ 9.4 مقابل 8.5. لدى GPT-5.2 Chat تكلفة benchmark أقل عند $0.393 مقابل $0.523. GPT-5.2 Chat أسرع عند 7.13s مقابل 16.02s، مع معدلات نجاح 74.6% مقابل 88.9%.
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-14
| المقياس | GPT-5.2 Chat GPT-5.2 Chat none | Qwen3.7 Max Qwen3.7 Max medium |
|---|---|---|
| النتيجة | 8.5 | 9.4 |
| الترتيب | #22 | #4 |
| الموثوقية | 10.0 | 10.0 |
| الاتساق | 8.9 | 9.6 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 74.6% | 88.9% |
| اختبارات غير مستقرة | 3 | 1 |
| إجمالي مرات التشغيل | 63 | 63 |
| التكلفة لكل نتيجة | 2.803 | 5.517 |
| إجمالي التكلفة | $0.393 | $0.523 |
| سعر الإدخال | $1.750 / 1M | $1.250 / 1M |
| سعر الإخراج | $14.000 / 1M | $3.750 / 1M |
| إجمالي رموز الإدخال | 34,212 | 42,360 |
| رموز الإخراج | 23,744 | 2,129 |
| رموز الاستدلال | 0 | 122,959 |
| زمن الاستجابة (المتوسط) | 7.13s | 16.02s |
| زمن الاستجابة (الحد الأقصى) | 38.52s | 59.98s |
| زمن الاستجابة (الإجمالي) | 149.69s | 336.51s |
عرض إنشاء
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| البرمجة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.2 Chat | 8.8 | 7.8 | 88.9% | 1 | 9.82s | 7,305 | 6,731 | 0 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 35.31s | 7,893 | 423 | 34,808 |
تبديل زوج المقارنة