ترتيب مجمّع
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في مجمّع، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: زمن الاستجابة (المتوسط) ↓.
316/316
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة مجمّع | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #193 | Inkling low | Thinkingmachines | 2.9 | 6.1 | $0.187 | 0/2 | 22.7s |
| #230 | Owl Alpha none | Openrouter | 1.5 | 5.6 | $0.000 | 0/1 | 21.7s |
| #290 | Laguna S 2.1 none | Poolside | 2.9 | 4.5 | $0.022 | 0/2 | 21.6s |
| #198 | Nemotron 3 Ultra none | NVIDIA | 3.0 | 6.1 | $0.093 | 0/2 | 21.1s |
| #37 | Claude Opus 5 low | Anthropic | 10.0 | 8.7 | $1.121 | 2/2 | 21.1s |
| #201 | Grok 4.20 Beta medium | X AI | 5.0 | 6.0 | $0.750 | 1/1 | 20.9s |
| #12 | Gemini 3.7 Flash medium | 10.0 | 9.4 | $0.309 | 2/2 | 20.9s | |
| #38 | Gemini 3.6 Flash low | 7.3 | 8.7 | $0.251 | 1/2 | 19.8s | |
| #104 | Gemini 3.8 Flash low | 3.8 | 7.5 | $0.239 | 0/2 | 19.6s | |
| #231 | KAT-Coder-Air V2.5 medium | Kwaipilot | 6.5 | 5.6 | $0.048 | 1/2 | 19.6s |
| #91 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.6 | $0.179 | 2/2 | 19.0s |
| #117 | Gemini 3.1 Flash Lite medium | 7.2 | 7.3 | $0.120 | 1/2 | 18.5s | |
| #161 | Claude Opus 4.7 none | Anthropic | 4.8 | 6.6 | $0.505 | 1/1 | 18.3s |
| #272 | Nemotron 3 Super none | NVIDIA | 3.0 | 4.8 | $0.008 | 0/2 | 18.2s |
| #77 | Gemini 3.5 Flash Lite medium | 7.3 | 7.8 | $0.272 | 1/2 | 17.9s |