ترتيب استدعاء الأدوات
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في استدعاء الأدوات، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: المقياس ↑.
330/330
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة استدعاء الأدوات | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #330 | LFM2-24B-A2B none | Liquid | 3.0 | 2.2 | $0.001 | 0/1 | 0ms |
| #59 | GPT-5.2 medium | OpenAI | 4.7 | 8.4 | $1.182 | 0/1 | 10.3s |
| #104 | GPT-5.6 Terra low | OpenAI | 4.7 | 7.5 | $0.420 | 0/1 | 6.69s |
| #110 | GPT-5.4 Mini medium | OpenAI | 4.7 | 7.5 | $0.786 | 0/1 | 9.62s |
| #152 | Seed-2.0-Code high | Bytedance Seed | 4.7 | 6.9 | $1.273 | 0/1 | 35.1s |
| #156 | Seed-2.0-Code medium | Bytedance Seed | 4.7 | 6.8 | $1.153 | 0/1 | 36.4s |
| #276 | MiniMax M2.7 medium | Minimax | 4.7 | 5.0 | $0.208 | 0/1 | 12.0s |
| #284 | Nemotron 3 Super none | NVIDIA | 4.7 | 4.8 | $0.008 | 0/1 | 16.0s |
| #302 | Laguna S 2.1 none | Poolside | 4.7 | 4.5 | $0.022 | 0/1 | 1.45s |
| #311 | Laguna Xs.2 medium | Poolside | 4.7 | 4.1 | $0.015 | 0/1 | 3.39s |
| #169 | GLM 5V Turbo medium | Z.ai | 7.0 | 6.7 | $0.457 | 0/1 | 12.5s |
| #244 | Qwen3.6 27B none | Qwen | 9.5 | 5.5 | $0.062 | 1/1 | 6.74s |
| #255 | DeepSeek V4 Flash 0731 none | DeepSeek | 9.5 | 5.4 | $0.009 | 1/1 | 4.61s |
| #275 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #33 | Muse Spark 1.3 high | Meta | 9.6 | 8.9 | $1.653 | 1/1 | 33.9s |