नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 4.7 (medium) vs Qwen3.8 Max (low)

average score जवळपास समान आहे: 8.7 vs 8.7. Qwen3.8 Max (low) चा benchmark खर्च कमी आहे: $0.687 vs $1.477. Claude Opus 4.7 (medium) वेगवान आहे: 7.61s vs 21.19s, pass rates 83.3% vs 84.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-04

क्रमांक
#22
एकूण आउटपुट टोकन्स
29,990
प्रतिसाद वेळ (सरासरी)
7.61s
एकूण खर्च
$1.477
क्रमांक
#23
एकूण आउटपुट टोकन्स
81,411
प्रतिसाद वेळ (सरासरी)
21.19s
एकूण खर्च
$0.687
शिफारस केलेले मॉडेल Qwen3.8 Max (low)

It has the best score here (8.7), while costing about 2.1x less than Claude Opus 4.7 (medium).

तपशीलवार तुलना

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium प्रकाशन: 2026-04-16 Qwen3.8 Max Qwen3.8 Max low प्रकाशन: 2026-08-04
स्कोअर 8.7 8.7
क्रमांक #22 #23
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.0
बेंचमार्क कव्हरेज 22/22 चाचण्या · 66/66 प्रयत्न 22/22 चाचण्या · 66/66 प्रयत्न
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 84.9%
अस्थिर चाचण्या 1 3
एकूण रन 66 66
प्रति निकाल खर्च 8.201 4.041
एकूण खर्च $1.477 $0.687
इनपुट किंमत $5.000 / 1M $2.000 / 1M
आउटपुट किंमत $25.000 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 145,252 99,172
आउटपुट टोकन्स 24,948 6,132
रिझनिंग टोकन्स 5,042 75,279
प्रतिसाद वेळ (सरासरी) 7.61s 21.19s
प्रतिसाद वेळ (कमाल) 65.40s 155.75s
प्रतिसाद वेळ (एकूण) 159.91s 466.14s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 Claude Opus 4.7

medium
खर्च
$0.059
वेळ
26.8s
टोकन्स
2,475 tok

#23 Qwen3.8 Max

low
खर्च
$0.026
वेळ
68.5s
टोकन्स
4,280 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952

झटपट तुलना

तुलना जोडी बदला