ترتيب الذكاء العام
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في الذكاء العام، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: زمن الاستجابة (المتوسط) ↓.
216/216
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة الذكاء العام | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #15 | Grok 4.5 high | X AI | 4.7 | 8.9 | $1.707 | 0/1 | 9.82s |
| #155 | KAT-Coder-Air V2.5 medium | Kwaipilot | 5.0 | 5.6 | $0.048 | 0/1 | 9.81s |
| #116 | Gemma 4 31B medium | 10.0 | 6.3 | $0.107 | 1/1 | 9.57s | |
| #139 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 1/1 | 9.34s | |
| #179 | DeepSeek V3.2 none | DeepSeek | 4.7 | 5.0 | $0.054 | 0/1 | 9.32s |
| #50 | DeepSeek V4 Pro high | DeepSeek | 10.0 | 7.7 | $0.200 | 1/1 | 8.83s |
| #94 | Qwen3.6 35B A3B medium | Qwen | 4.4 | 6.7 | $0.746 | 0/1 | 8.66s |
| #127 | gpt-oss-120b medium | OpenAI | 4.3 | 6.1 | $0.019 | 0/1 | 7.90s |
| #30 | Muse Spark 1.1 high | Meta | 10.0 | 8.1 | $1.694 | 1/1 | 7.73s |
| #20 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.478 | 1/1 | 7.42s |
| #150 | KAT-Coder-Air V2.5 high | Kwaipilot | 5.1 | 5.6 | $0.077 | 0/1 | 7.10s |
| #71 | Step 3.7 Flash low | Stepfun | 3.4 | 7.3 | $0.454 | 0/1 | 7.00s |
| #146 | Nemotron 3 Super medium | NVIDIA | 4.1 | 5.7 | $0.055 | 0/1 | 6.91s |
| #174 | MiMo-V2.5 none | Xiaomi | 4.4 | 5.1 | $0.025 | 0/1 | 6.86s |
| #33 | Step 3.7 Flash medium | Stepfun | 4.0 | 8.0 | $0.515 | 0/1 | 6.85s |