नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 4.7 (medium) vs Qwen3.8 Flash Next (low)

Claude Opus 4.7 (medium) average score में आगे है: 8.1 vs 8.0. Qwen3.8 Flash Next (low) की benchmark लागत कम है: ~$0.045 vs $3.636. Claude Opus 4.7 (medium) तेज है: 14.12s vs 23.66s, pass rates 81.2% vs 79.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#93
कुल आउटपुट टोकन
57,978
प्रतिक्रिया समय (औसत)
14.12s
कुल लागत
$3.636
रैंक
#100
कुल आउटपुट टोकन
135,295
प्रतिक्रिया समय (औसत)
23.66s
कुल लागत
~$0.045
अनुशंसित मॉडल Qwen3.8 Flash Next (low)

Its score stays close to the best score here (8.0 vs 8.1), while costing about 81.1x less than Claude Opus 4.7 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium रिलीज़: 2026-04-16 Qwen3.8 Flash Next Qwen3.8 Flash Next low रिलीज़: 2026-10-04
स्कोर 8.1 8.0
रैंक #93 #100
विश्वसनीयता 10.0 10.0
संगति 9.3 8.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 81.2% 79.7%
अस्थिर टेस्ट 2 6
कुल रन 69 69
प्रति परिणाम लागत 20.200 ~0.299
कुल लागत $3.636 ~$0.045
इनपुट कीमत $5.000 / 1M लागू नहीं
आउटपुट कीमत $25.000 / 1M लागू नहीं
कैश पढ़ने की कीमत $0.500 / 1M लागू नहीं
कैश लिखने की कीमत $6.250 / 1M लागू नहीं
कुल इनपुट टोकन 437,293 342,163
आउटपुट टोकन 29,102 1,518
रीजनिंग टोकन 28,876 133,777
प्रतिक्रिया समय (औसत) 14.12s 23.66s
प्रतिक्रिया समय (अधिकतम) 150.60s 166.72s
प्रतिक्रिया समय (कुल) 310.55s 544.16s
पैरामीटर ~5T कुल (~500B सक्रिय) 180B कुल (6B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Claude Opus 4.7

medium
लागत
$0.059
समय
26.8s
टोकन
2,475 tok

#100 Qwen3.8 Flash Next

low
लागत
~$0.002
समय
47.2s
टोकन
5,270 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

तुलना जोड़ी बदलें

Claude Opus 4.7mediumvsDeepSeek V4 Flash 0423highGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsDeepSeek V4 Pro 0423highClaude Opus 4.7mediumvsDeepSeek V4.1 FlashlowQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 Ultramediumनिःशुल्क उपलब्धvsQwen3.8 Flash NextlowGPT-5.4 MinimediumvsQwen3.8 Flash NextlowGPT-5.6 LunahighvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsGPT-5.6 LunahighClaude Opus 4.7mediumvsSeed-2.0-Codelow