नेविगेशन
AI BENCHY
Advertise here

Claude Opus 4.8 vs Qwen3.7 Plus

Claude Opus 4.8 average score में आगे है: 7.3 vs 7.2. Qwen3.7 Plus की benchmark लागत कम है: $0.106 vs $1.166. Claude Opus 4.8 तेज है: 4.91s vs 12.09s, pass rates 63.6% vs 50.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#74
कुल आउटपुट टोकन
16,797
प्रतिक्रिया समय (औसत)
4.91s
कुल लागत
$1.166
रैंक
#79
कुल आउटपुट टोकन
58,097
प्रतिक्रिया समय (औसत)
12.09s
कुल लागत
$0.106
अनुशंसित मॉडल Qwen3.7 Plus

Its score stays close to the best score here (7.2 vs 7.3), while costing about 11.0x less than Claude Opus 4.8.

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none रिलीज़: 2026-05-28 Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03
स्कोर 7.3 7.2
रैंक #74 #79
विश्वसनीयता 10.0 10.0
संगति 9.2 10.0
सही परीक्षण
प्रति प्रयास पास दर 63.6% 50.0%
अस्थिर टेस्ट 2 0
कुल रन 66 66
प्रति परिणाम लागत 8.969 1.014
कुल लागत $1.166 $0.106
इनपुट कीमत $5.000 / 1M $0.320 / 1M
आउटपुट कीमत $25.000 / 1M $1.280 / 1M
कुल इनपुट टोकन 149,206 98,824
आउटपुट टोकन 16,797 58,097
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 4.91s 12.09s
प्रतिक्रिया समय (अधिकतम) 35.03s 206.03s
प्रतिक्रिया समय (कुल) 108.03s 265.89s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Opus 4.8

none
लागत
$0.053
समय
22.0s
टोकन
2,253 tok

#79 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

त्वरित तुलना

तुलना जोड़ी बदलें