Eșecuri pe categorii AI BENCHY
Specific domeniului: Eroare API
Specific domeniului
Eroare API
Vezi ce modele AI au cele mai mari șanse să întâmpine Eroare API la Specific domeniului, ca să găsești mai repede punctele slabe. Sortează după: Teste corecte ↓.
Motive de eșec
| Rang | Model | Companie | Număr de Eroare API | Scor de categorie | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|
| #132 | Mistral Small 4 medium | Mistral | 1 | 5.3 | 1/3 | 6.11s |
| #160 | LFM2-24B-A2B none | Liquid | 1 | 5.9 | 1/3 | 287ms |
| #93 | Qwen3.6 Plus Preview medium | Qwen | 1 | 3.0 | 0/3 | 22.1s |
| #103 | DeepSeek V4 Pro high | DeepSeek | 1 | 2.9 | 0/3 | 205.7s |
| #133 | DeepSeek V3.2 none | DeepSeek | 1 | 2.9 | 0/3 | 4.17s |
| #156 | Hy3 preview none | Tencent | 1 | 3.6 | 0/3 | 17.6s |