नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs Qwen: Qwen3.7 Max

Claude Opus 5 (high) average score मध्ये पुढे आहे: 9.2 vs 9.2. Qwen3.7 Max (medium) चा benchmark खर्च कमी आहे: $1.116 vs $2.835. Claude Opus 5 (high) वेगवान आहे: 20.44s vs 40.57s, pass rates 84.9% vs 87.9%.

शिफारस केलेले मॉडेलQwen3.7 Max (medium)Its score stays close to the best score here (9.2 vs 9.2), while costing about 2.5x less than Claude Opus 5 (high).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 high प्रकाशन: 2026-07-25 Qwen3.7 Max Qwen3.7 Max medium प्रकाशन: 2026-05-22
स्कोअर 9.2 9.2
क्रमांक #11 #13
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 84.9% 87.9%
अस्थिर चाचण्या 1 2
एकूण रन 66 66
प्रति निकाल खर्च 15.747 8.292
एकूण खर्च $2.835 $1.116
इनपुट किंमत $5.000 / 1M $1.475 / 1M
आउटपुट किंमत $25.000 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 135,959 106,020
आउटपुट टोकन्स 67,066 5,748
रिझनिंग टोकन्स 19,114 211,004
प्रतिसाद वेळ (सरासरी) 20.44s 40.57s
प्रतिसाद वेळ (कमाल) 159.01s 556.06s
प्रतिसाद वेळ (एकूण) 449.68s 892.57s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
खर्च
$0.265
वेळ
144.5s
टोकन्स
10,741 tok

#13 Qwen3.7 Max

medium
खर्च
$0.017
वेळ
68.8s
टोकन्स
4,526 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808

झटपट तुलना

तुलना जोडी बदला