नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs Qwen: Qwen3.5 Plus 2026-02-15

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-01

मेट्रिक Claude Opus 4.6 Claude Opus 4.6 medium प्रकाशन: 2026-02-05 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none प्रकाशन: 2026-02-15
स्कोअर 7.6 6.8
क्रमांक #50 #65
विश्वसनीयता लागू नाही लागू नाही
सुसंगतता 9.1 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 70.4% 53.7%
अस्थिर चाचण्या 2 2
एकूण रन 54 54
प्रति निकाल खर्च 12.047 0.182
एकूण खर्च $1.446 $0.017
???? ??? $5.000 / 1M $0.260 / 1M
????? ??? $25.000 / 1M $1.560 / 1M
आउटपुट टोकन्स 29,829 2,461
रिझनिंग टोकन्स 18,938 0
प्रतिसाद वेळ (सरासरी) 21.08s 2.60s
प्रतिसाद वेळ (कमाल) 83.40s 6.65s
प्रतिसाद वेळ (एकूण) 231.84s 31.23s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 986 1,071
Qwen3.5 Plus 2026-02-15 4.8 10.0 25.0% 0 1.91s 517 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 23.11s 3,486 1,504
Qwen3.5 Plus 2026-02-15 6.3 3.7 33.3% 1 3.63s 443 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 8,178 5,194
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 6.65s 314 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 691 757
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.89s 243 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 14,642 8,687
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 1.17s 17 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 188 292
Qwen3.5 Plus 2026-02-15 4.4 3.0 33.3% 1 2.26s 117 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 266 467
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.67s 72 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 7.7 10.0 66.7% 0 4.60s 531 637
Qwen3.5 Plus 2026-02-15 7.7 10.0 66.7% 0 2.82s 516 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 861 329
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 3.33s 222 0

झटपट तुलना

तुलना जोडी बदला