AI BENCHY Compare
Inception: Mercury 2 vs xAI: Grok 4.20
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-02
| المقياس | Mercury 2 Mercury 2 medium | Grok 4.20 Grok 4.20 none |
|---|---|---|
| النتيجة | 6.3 | 5.4 |
| الترتيب | #51 | #69 |
| الاتساق | 8.5 | 9.5 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 51.0% | 31.4% |
| اختبارات غير مستقرة | 3 | 1 |
| إجمالي مرات التشغيل | 51 | 51 |
| التكلفة لكل نتيجة | 0.634 | 1.809 |
| إجمالي التكلفة | $0.045 | $0.091 |
| ??? ??????? | $0.250 / 1M | $2.000 / 1M |
| ??? ??????? | $0.750 / 1M | $6.000 / 1M |
| رموز الإخراج | 3,723 | 1,655 |
| رموز الاستدلال | 46,120 | 0 |
| زمن الاستجابة (المتوسط) | 2.25s | 1.11s |
| زمن الاستجابة (الحد الأقصى) | 14.63s | 6.04s |
| زمن الاستجابة (الإجمالي) | 35.99s | 18.80s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
DeepSeek V3.2nonevsMercury 2mediumMercury 2mediumvsMiMo-V2-OmninoneMistral Small 4mediumvsGrok 4.20noneMercury 2mediumvsQwen3.5-FlashnoneMercury 2mediumvsGLM 5V TurbononeSeed-2.0-LitenonevsMercury 2mediumMiniMax M2.7mediumvsGrok 4.20noneGemini 2.5 FlashnonevsMercury 2mediumMercury 2mediumvsQwen3.5-35B-A3BnoneMercury 2mediumvsGLM 5noneGemma 4 31BnonevsMercury 2mediumMercury 2mediumvsHunter Alphanone