Categorie AI BENCHY
Clasament Inteligență generală
Vezi ce modele AI se descurcă cel mai bine la Inteligență generală, care rămân fiabile și unde apar cele mai mari diferențe. Sortează după: Metrică ↑.
| Rang | Model | Companie | Scor Inteligență generală | Scor | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|
| #133 | DeepSeek V3.2 none | DeepSeek | 4.7 | 5.2 | 0/1 | 9.32s |
| #21 | GPT-5.4 medium | OpenAI | 4.7 | 8.0 | 0/1 | 4.92s |
| #28 | Gemini 2.5 Flash medium | 4.8 | 7.8 | 0/1 | 4.86s | |
| #81 | Mercury 2 medium | Inception | 4.8 | 6.6 | 0/1 | 821ms |
| #114 | Qwen3.5 Plus 2026-04-20 none | Qwen | 4.8 | 5.7 | 0/1 | 1.41s |
| #126 | gpt-oss-120b none | OpenAI | 4.8 | 5.4 | 0/1 | 10.8s |
| #127 | Grok 4.20 none | X AI | 4.8 | 5.4 | 0/1 | 659ms |
| #132 | Mistral Small 4 medium | Mistral | 4.8 | 5.3 | 0/1 | 2.05s |
| #144 | GPT-5.4 Mini none | OpenAI | 4.8 | 4.9 | 0/1 | 1.82s |
| #155 | Mercury 2 none | Inception | 4.8 | 4.5 | 0/1 | 628ms |
| #39 | Qwen3.6 Flash medium | Qwen | 4.8 | 7.5 | 0/1 | 9.88s |
| #36 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 4.9 | 7.6 | 0/1 | 25.3s |
| #97 | Gemini 2.5 Flash none | 5.0 | 6.2 | 0/1 | 615ms | |
| #104 | Nemotron 3 Ultra 550b A55b none | NVIDIA | 5.0 | 6.0 | 0/1 | 13.5s |
| #106 | Grok 4.20 Beta none | X AI | 5.0 | 5.8 | 0/1 | 541ms |