नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.5 vs Qwen3.5-35B-A3B (medium)

GPT-5.5 average score मध्ये पुढे आहे: 6.9 vs 6.2. GPT-5.5 चा benchmark खर्च कमी आहे: $0.544 vs $0.837. GPT-5.5 वेगवान आहे: 2.36s vs 112.47s, pass rates 56.1% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#98
एकूण आउटपुट टोकन्स
4,915
प्रतिसाद वेळ (सरासरी)
2.36s
एकूण खर्च
$0.544
क्रमांक
#133
एकूण आउटपुट टोकन्स
826,670
प्रतिसाद वेळ (सरासरी)
112.47s
एकूण खर्च
$0.837
शिफारस केलेले मॉडेल GPT-5.5

It has the best score here (6.9), while costing about 1.5x less than Qwen3.5-35B-A3B (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.5 GPT-5.5 none प्रकाशन: 2026-04-24 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium प्रकाशन: 2026-02-24
स्कोअर 6.9 6.2
क्रमांक #98 #133
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 7.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 56.1% 66.7%
अस्थिर चाचण्या 3 6
एकूण रन 66 66
प्रति निकाल खर्च 4.945 9.130
एकूण खर्च $0.544 $0.837
इनपुट किंमत $5.000 / 1M $0.140 / 1M
आउटपुट किंमत $30.000 / 1M $1.000 / 1M
एकूण इनपुट टोकन्स 79,285 130,388
आउटपुट टोकन्स 4,915 40,630
रिझनिंग टोकन्स 0 786,040
प्रतिसाद वेळ (सरासरी) 2.36s 112.47s
प्रतिसाद वेळ (कमाल) 12.24s 950.25s
प्रतिसाद वेळ (एकूण) 51.88s 2474.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 GPT-5.5

none
खर्च
$0.090
वेळ
54.3s
टोकन्स
3,063 tok

#133 Qwen3.5-35B-A3B

medium
खर्च
$0.009
वेळ
71.4s
टोकन्स
8,631 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

झटपट तुलना

तुलना जोडी बदला