नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 Max Preview

सारांश

GPT-5.5 (low) average score मध्ये पुढे आहे: 9.3 vs 8.9. GPT-5.5 (low) चा benchmark खर्च कमी आहे: $0.907 vs $0.960. GPT-5.5 (low) वेगवान आहे: 9.76s vs 59.63s, pass rates 85.7% vs 81.0%.

शिफारस केलेले मॉडेलGPT-5.5 (low)It has the best score here (9.3), while responding about 6.1x faster than Qwen3.6 Max Preview (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-14

मेट्रिक GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24 Qwen3.6 Max Preview Qwen3.6 Max Preview medium प्रकाशन: 2026-04-20
स्कोअर 9.3 8.9
क्रमांक #7 #14
विश्वसनीयता 10.0 10.0
सुसंगतता 10.0 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 85.7% 81.0%
अस्थिर चाचण्या 0 2
एकूण रन 63 63
प्रति निकाल खर्च 5.035 7.024
एकूण खर्च $0.907 $0.960
इनपुट किंमत $5.000 / 1M $1.040 / 1M
आउटपुट किंमत $30.000 / 1M $6.240 / 1M
एकूण इनपुट टोकन्स 34,209 42,362
आउटपुट टोकन्स 2,046 2,273
रिझनिंग टोकन्स 22,460 144,367
प्रतिसाद वेळ (सरासरी) 9.76s 59.63s
प्रतिसाद वेळ (कमाल) 56.19s 238.07s
प्रतिसाद वेळ (एकूण) 204.92s 1252.17s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#7 GPT-5.5

low
खर्च
$0.068
वेळ
37.0s
टोकन्स
2,339 tok

#14 Qwen3.6 Max Preview

medium
खर्च
$0.024
वेळ
76.5s
टोकन्स
3,861 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

झटपट तुलना

तुलना जोडी बदला