AI BENCHY श्रेणी
डेटा पार्सिंग आणि निष्कर्षण क्रमवारी
डेटा पार्सिंग आणि निष्कर्षण मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा.
दाखवलेली मॉडेल्स
15
सरासरी डेटा पार्सिंग आणि निष्कर्षण स्कोअर
9.0
सर्वोत्तम मॉडेल
Step 3.5 Flash 10.0| क्रमांक | मॉडेल | कंपनी | डेटा पार्सिंग आणि निष्कर्षण स्कोअर | स्कोअर | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|
| #70 | Qwen3.5-122B-A10B none | Qwen | 10.0 | 5.7 | 2/2 | 1.01s |
| #72 | Hunter Alpha none | OpenRouter | 10.0 | 5.7 | 2/2 | 8.49s |
| #75 | GLM 5.1 none | Z.ai | 10.0 | 5.6 | 2/2 | 1.08s |
| #77 | GLM 5 Turbo none | Z.ai | 10.0 | 5.5 | 2/2 | 2.47s |
| #78 | Trinity Large Preview none | Arcee AI | 10.0 | 5.3 | 2/2 | 3.26s |
| #79 | Grok 4.20 Beta none | X AI | 10.0 | 5.3 | 2/2 | 601ms |
| #82 | Grok 4.20 none | X AI | 10.0 | 5.2 | 2/2 | 522ms |
| #83 | Mistral Small 4 none | Mistral | 10.0 | 5.2 | 2/2 | 822ms |
| #86 | GPT-5.4 Mini none | OpenAI | 10.0 | 5.1 | 2/2 | 1.30s |
| #88 | Nemotron 3 Super none | NVIDIA | 10.0 | 5.1 | 2/2 | 7.92s |
| #89 | GPT-4o-mini none | OpenAI | 10.0 | 4.9 | 2/2 | 1.27s |
| #90 | Qwen3.5-9B none | Qwen | 10.0 | 4.8 | 2/2 | 847ms |
| #95 | Grok 4.1 Fast none | X AI | 10.0 | 4.5 | 2/2 | 943ms |
| #32 | Qwen3.5-Flash medium | Qwen | 7.3 | 7.8 | 1/2 | 57.0s |
| #43 | Qwen3.5-35B-A3B medium | Qwen | 7.3 | 7.4 | 1/2 | 59.3s |