AI BENCHY श्रेणी
सामान्य ज्ञान रैंकिंग
देखें कि सामान्य ज्ञान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
169/169
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | सामान्य ज्ञान स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #49 | Claude Opus 4.7 none | Anthropic | 3.0 | 7.4 | $0.505 | 0/1 | 1.46s |
| #3 | Qwen3.7 Max medium | Qwen | 3.0 | 9.4 | $0.523 | 0/1 | 33.4s |
| #27 | GPT-5.4 Mini medium | OpenAI | 3.0 | 8.0 | $0.526 | 0/1 | 30.1s |
| #29 | Qwen3.5-27B medium | Qwen | 3.0 | 7.9 | $0.536 | 0/1 | 85.1s |
| #57 | Claude Opus 4.8 none | Anthropic | 3.0 | 7.2 | $0.539 | 0/1 | 3.41s |
| #160 | Grok Build 0.1 none | X AI | 3.0 | 4.2 | $0.547 | 0/1 | 36.1s |
| #22 | GPT-5.2 medium | OpenAI | 3.0 | 8.4 | $0.548 | 0/1 | 28.2s |
| #8 | Gemini 3.5 Flash medium | 10.0 | 9.1 | $0.582 | 1/1 | 2.75s | |
| #65 | Kimi K2.7 Code medium | Moonshot AI | 3.0 | 7.0 | $0.583 | 0/1 | 341.8s |
| #36 | Qwen3.5-122B-A10B medium | Qwen | 3.0 | 7.7 | $0.588 | 0/1 | 52.9s |
| #53 | Grok 4.20 medium | X AI | 3.0 | 7.3 | $0.609 | 0/1 | 63.5s |
| #37 | Grok 4.3 medium | X AI | 3.0 | 7.7 | $0.614 | 0/1 | 44.5s |
| #2 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.667 | 1/1 | 5.50s | |
| #13 | Claude Opus 4.7 medium | Anthropic | 3.0 | 8.7 | $0.679 | 0/1 | 2.25s |
| #73 | Mimo V2 Omni medium | Xiaomi | 3.0 | 6.8 | $0.683 | 0/1 | 234.2s |