नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 4.6 (medium) vs Qwen3.8 27B (low)

Qwen3.8 27B (low) average score मध्ये पुढे आहे: 7.9 vs 7.7. Qwen3.8 27B (low) चा benchmark खर्च कमी आहे: ~$0.071 vs $2.961. Claude Opus 4.6 (medium) वेगवान आहे: 32.23s vs 39.11s, pass rates 63.6% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#74
एकूण आउटपुट टोकन्स
96,722
प्रतिसाद वेळ (सरासरी)
32.23s
एकूण खर्च
$2.961
क्रमांक
#61
एकूण आउटपुट टोकन्स
169,329
प्रतिसाद वेळ (सरासरी)
39.11s
एकूण खर्च
~$0.071
शिफारस केलेले मॉडेल Qwen3.8 27B (low)

It has the best score here (7.9), while costing about 41.8x less than Claude Opus 4.6 (medium).

तपशीलवार तुलना

मेट्रिक Claude Opus 4.6 Claude Opus 4.6 medium प्रकाशन: 2026-02-05 Qwen3.8 27B Qwen3.8 27B low प्रकाशन: 2026-08-14
स्कोअर 7.7 7.9
क्रमांक #74 #61
विश्वसनीयता 10.0 10.0
सुसंगतता 8.8 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 68.2%
अस्थिर चाचण्या 3 0
एकूण रन 66 66
प्रति निकाल खर्च 22.777 ~0.473
एकूण खर्च $2.961 ~$0.071
इनपुट किंमत $5.000 / 1M लागू नाही
आउटपुट किंमत $25.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 108,573 99,705
आउटपुट टोकन्स 69,994 1,545
रिझनिंग टोकन्स 26,728 167,784
प्रतिसाद वेळ (सरासरी) 32.23s 39.11s
प्रतिसाद वेळ (कमाल) 151.51s 376.04s
प्रतिसाद वेळ (एकूण) 515.65s 860.51s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Opus 4.6

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

#61 Qwen3.8 27B

low
खर्च
~$0.003
वेळ
92.8s
टोकन्स
6,902 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

झटपट तुलना

तुलना जोडी बदला

Qwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowClaude Opus 4.6mediumvsSeed-2.0-CodelowKimi K3maxvsQwen3.8 27BlowClaude Opus 4.6mediumvsDeepSeek V4 ProhighClaude Opus 4.6mediumvsQwen3.7 FlashhighGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumClaude Opus 4.6mediumvsDeepSeek V4 Flash 0423highGPT-5.6 TerramediumvsQwen3.8 27Blow