नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs Qwen: Qwen3.6 Max Preview

Claude Opus 5 (low) average score मध्ये पुढे आहे: 8.6 vs 8.4. Claude Opus 5 (low) चा benchmark खर्च कमी आहे: $1.121 vs $1.143. Claude Opus 5 (low) वेगवान आहे: 6.99s vs 67.53s, pass rates 80.3% vs 80.3%.

शिफारस केलेले मॉडेलClaude Opus 5 (low)It has the best score here (8.6), while responding about 9.7x faster than Qwen3.6 Max Preview (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 low प्रकाशन: 2026-07-25 Qwen3.6 Max Preview Qwen3.6 Max Preview medium प्रकाशन: 2026-04-20
स्कोअर 8.6 8.4
क्रमांक #23 #25
विश्वसनीयता 10.0 9.9
सुसंगतता 9.3 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 80.3% 80.3%
अस्थिर चाचण्या 2 3
एकूण रन 66 66
प्रति निकाल खर्च 6.593 8.173
एकूण खर्च $1.121 $1.143
इनपुट किंमत $5.000 / 1M $1.040 / 1M
आउटपुट किंमत $25.000 / 1M $6.240 / 1M
एकूण इनपुट टोकन्स 134,773 79,240
आउटपुट टोकन्स 14,123 5,098
रिझनिंग टोकन्स 3,896 164,842
प्रतिसाद वेळ (सरासरी) 6.99s 67.53s
प्रतिसाद वेळ (कमाल) 30.67s 238.07s
प्रतिसाद वेळ (एकूण) 153.73s 1485.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Claude Opus 5

low
खर्च
$0.062
वेळ
30.2s
टोकन्स
2,615 tok

#25 Qwen3.6 Max Preview

medium
खर्च
$0.024
वेळ
76.5s
टोकन्स
3,861 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 7.8 7.4 77.8% 1 6.70s 10,590 2,442 760
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

झटपट तुलना

तुलना जोडी बदला