#16 Claude Opus 4.7
medium- التكلفة
- $0.059
- الوقت
- 26.8s
- الرموز
- 2,475 tok
AI BENCHY Compare
الملخص
يتقدم Claude Opus 4.7 (medium) في متوسط النتيجة بـ 8.7 مقابل 7.5. لدى GPT-5.3 Chat تكلفة benchmark أقل عند $0.433 مقابل $0.679. Claude Opus 4.7 (medium) أسرع عند 4.73s مقابل 6.34s، مع معدلات نجاح 82.5% مقابل 66.7%.
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-14
| المقياس | Claude Opus 4.7 Claude Opus 4.7 medium | GPT-5.3 Chat GPT-5.3 Chat none |
|---|---|---|
| النتيجة | 8.7 | 7.5 |
| الترتيب | #16 | #61 |
| الموثوقية | 10.0 | 10.0 |
| الاتساق | 9.6 | 8.1 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 82.5% | 66.7% |
| اختبارات غير مستقرة | 1 | 5 |
| إجمالي مرات التشغيل | 63 | 63 |
| التكلفة لكل نتيجة | 3.991 | 3.605 |
| إجمالي التكلفة | $0.679 | $0.433 |
| سعر الإدخال | $5.000 / 1M | $1.750 / 1M |
| سعر الإخراج | $25.000 / 1M | $14.000 / 1M |
| إجمالي رموز الإدخال | 65,406 | 34,209 |
| رموز الإخراج | 11,858 | 26,617 |
| رموز الاستدلال | 2,198 | 0 |
| زمن الاستجابة (المتوسط) | 4.73s | 6.34s |
| زمن الاستجابة (الحد الأقصى) | 23.18s | 18.33s |
| زمن الاستجابة (الإجمالي) | 94.51s | 133.13s |
عرض إنشاء
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| البرمجة | النتيجة | الاتساق | معدل النجاح لكل محاولة | اختبارات غير مستقرة | اختبارات صحيحة | زمن الاستجابة (المتوسط) | رموز الإدخال | رموز الإخراج | رموز الاستدلال |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 7.6 | 7.2 | 77.8% | 1 | 12.96s | 10,635 | 7,629 | 1,114 | |
| GPT-5.3 Chat | 5.6 | 4.7 | 55.6% | 2 | 10.52s | 7,302 | 6,632 | 0 |
تبديل زوج المقارنة