AI BENCHY श्रेणी
सामान्य ज्ञान रैंकिंग
देखें कि सामान्य ज्ञान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
169/169
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | सामान्य ज्ञान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #157 | GLM 4.7 Flash medium | Z.ai | 3.0 | 4.3 | $0.054 | 0/1 | 11.1s |
| #158 | Hy3 preview none | Tencent | 3.0 | 4.3 | $0.003 | 0/1 | 2.71s |
| #159 | MiMo-V2-Flash none | Xiaomi | 3.0 | 4.3 | $0.025 | 0/1 | 1.82s |
| #160 | Grok Build 0.1 none | X AI | 3.0 | 4.2 | $0.547 | 0/1 | 36.1s |
| #161 | Grok 4.1 Fast none | X AI | 3.0 | 4.0 | $0.008 | 0/1 | 731ms |
| #162 | Laguna Xs.2 none | Poolside | 3.0 | 4.0 | $0.000 | 0/1 | 0ms |
| #163 | Granite 4.1 8B none | IBM Granite | 3.0 | 4.0 | $0.003 | 0/1 | 306ms |
| #164 | gpt-oss-120b none | OpenAI | 3.0 | 4.0 | $0.010 | 0/1 | 47.3s |
| #165 | Qwen3.5-9B medium | Qwen | 3.0 | 3.8 | $0.036 | 0/1 | 177.0s |
| #166 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 3.0 | 3.6 | $0.000 | 0/1 | 0ms |
| #167 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.0 | 3.5 | $0.000 | 0/1 | 0ms |
| #168 | Step 3.5 Flash none | Stepfun | 3.0 | 2.6 | $0.020 | 0/1 | 114.1s |
| #169 | LFM2-24B-A2B none | Liquid | 0.0 | 2.4 | $0.001 | 0/0 | 0ms |
| #1 | Gemini 3.5 Flash high | 10.0 | 9.8 | $1.115 | 1/1 | 3.94s | |
| #2 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.667 | 1/1 | 5.50s |