ترتيب خاص بالمجال
اكتشف أي نماذج الذكاء الاصطناعي تؤدي أفضل في خاص بالمجال، وأيها يظل أكثر اعتمادية، وأين تظهر أكبر الفجوات. الترتيب حسب: اختبارات صحيحة ↓.
210/210
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | درجة خاص بالمجال | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #13 | GPT-5.3-Codex medium | OpenAI | 5.9 | 8.9 | $0.920 | 1/3 | 64.3s |
| #14 | Claude Opus 4.8 medium | Anthropic | 5.3 | 8.8 | $1.931 | 1/3 | 14.6s |
| #17 | Claude Fable 5 medium | Anthropic | 5.3 | 8.6 | $3.478 | 1/3 | 53.4s |
| #18 | GPT-5.4 medium | OpenAI | 5.3 | 8.5 | $1.533 | 1/3 | 74.3s |
| #21 | GPT-5.2 medium | OpenAI | 5.9 | 8.4 | $0.951 | 1/3 | 77.8s |
| #25 | Gemini 2.5 Flash medium | 5.9 | 8.2 | $0.643 | 1/3 | 37.3s | |
| #30 | GPT-5.2 Chat none | OpenAI | 5.3 | 8.0 | $0.604 | 1/3 | 17.8s |
| #32 | Inkling medium | Thinkingmachines | 5.3 | 8.0 | $0.391 | 1/3 | 35.6s |
| #33 | Kimi K3 max | Moonshot AI | 5.9 | 8.0 | $3.112 | 1/3 | 490.1s |
| #34 | GPT-5.6 Terra high | OpenAI | 5.3 | 8.0 | $1.055 | 1/3 | 43.4s |
| #35 | Seed-2.0-Lite medium | Bytedance Seed | 5.9 | 7.9 | $0.234 | 1/3 | 88.7s |
| #39 | GPT-5.6 Terra medium | OpenAI | 5.3 | 7.8 | $0.676 | 1/3 | 23.4s |
| #41 | Claude Opus 4.8 low | Anthropic | 5.3 | 7.8 | $2.077 | 1/3 | 45.5s |
| #47 | MiniMax M3 medium | Minimax | 5.5 | 7.6 | $0.286 | 1/3 | 233.1s |
| #48 | Grok Build 0.1 medium | X AI | 5.3 | 7.6 | $1.097 | 1/3 | 158.0s |