AI BENCHY श्रेणी
सामान्य ज्ञान क्रमवारी
सामान्य ज्ञान मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: प्रतिसाद वेळ (सरासरी) ↑.
अयशस्वी होण्याची कारणे
| क्रमांक | मॉडेल | कंपनी | सामान्य ज्ञान स्कोअर | स्कोअर | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|
| #10 | Gemini 3 PRO Preview medium | 0.0 | 8.4 | 0/0 | 0ms | |
| #15 | Qwen3.6 Plus Preview medium | Qwen | 0.0 | 8.2 | 0/0 | 0ms |
| #63 | Laguna M.1 medium | Poolside | 0.0 | 6.9 | 0/0 | 0ms |
| #75 | Laguna Xs.2 medium | Poolside | 0.0 | 6.6 | 0/0 | 0ms |
| #109 | Elephant Alpha medium | Openrouter | 0.0 | 5.5 | 0/0 | 0ms |
| #111 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 0.0 | 5.4 | 0/0 | 0ms |
| #115 | Laguna M.1 none | Poolside | 0.0 | 5.4 | 0/0 | 0ms |
| #116 | Elephant Alpha none | Openrouter | 0.0 | 5.3 | 0/0 | 0ms |
| #117 | Laguna Xs.2 none | Poolside | 0.0 | 5.3 | 0/0 | 0ms |
| #134 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 0.0 | 4.6 | 0/0 | 0ms |
| #138 | Ling-2.6-1T none | Inclusionai | 0.0 | 4.5 | 0/0 | 0ms |
| #110 | Qwen3.5-122B-A10B none | Qwen | 3.0 | 5.5 | 0/1 | 295ms |
| #142 | Granite 4.1 8B none | IBM Granite | 3.0 | 4.1 | 0/1 | 306ms |
| #124 | Mistral Small 4 none | Mistral | 3.0 | 5.1 | 0/1 | 397ms |
| #129 | Qwen3 Coder Next medium | Qwen | 3.0 | 4.8 | 0/1 | 399ms |