AI BENCHY श्रेणी
सामान्य ज्ञान रैंकिंग
देखें कि सामान्य ज्ञान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
169/169
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | सामान्य ज्ञान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #11 | Qwen3.6 Max Preview medium | Qwen | 3.0 | 8.9 | $0.960 | 0/1 | 60.6s |
| #12 | Claude Opus 4.8 medium | Anthropic | 3.0 | 8.8 | $1.107 | 0/1 | 6.14s |
| #13 | Claude Opus 4.7 medium | Anthropic | 3.0 | 8.7 | $0.679 | 0/1 | 2.25s |
| #14 | GLM 5.2 medium | Z.ai | 3.0 | 8.7 | $0.324 | 0/1 | 34.2s |
| #15 | GLM 5 medium | Z.ai | 3.0 | 8.6 | $0.228 | 0/1 | 67.4s |
| #16 | GPT-5 Mini medium | OpenAI | 3.0 | 8.5 | $0.159 | 0/1 | 9.99s |
| #17 | GPT-5.4 medium | OpenAI | 3.0 | 8.5 | $1.210 | 0/1 | 14.0s |
| #18 | Seed-2.0-Lite medium | Bytedance Seed | 3.0 | 8.5 | $0.175 | 0/1 | 48.3s |
| #19 | GPT-5.2 Chat none | OpenAI | 3.0 | 8.5 | $0.393 | 0/1 | 6.89s |
| #20 | Step 3.7 Flash medium | Stepfun | 3.0 | 8.5 | $0.376 | 0/1 | 114.0s |
| #21 | GLM 5 Turbo medium | Z.ai | 3.0 | 8.4 | $0.323 | 0/1 | 40.2s |
| #22 | GPT-5.2 medium | OpenAI | 3.0 | 8.4 | $0.548 | 0/1 | 28.2s |
| #23 | DeepSeek V4 Flash high | DeepSeek | 3.0 | 8.3 | $0.027 | 0/1 | 54.5s |
| #24 | Gemini 2.5 Flash medium | 3.0 | 8.2 | $0.379 | 0/1 | 2.76s | |
| #25 | Qwen3.7 Plus medium | Qwen | 3.0 | 8.2 | $0.177 | 0/1 | 91.1s |