नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.5-27B (medium)

GPT-5.2 Chat average score मध्ये पुढे आहे: 8.0 vs 7.4. GPT-5.2 Chat चा benchmark खर्च कमी आहे: $0.604 vs $0.981. GPT-5.2 Chat वेगवान आहे: 7.65s vs 111.94s, pass rates 74.2% vs 72.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#37
एकूण आउटपुट टोकन्स
30,424
प्रतिसाद वेळ (सरासरी)
7.65s
एकूण खर्च
$0.604
क्रमांक
#67
एकूण आउटपुट टोकन्स
614,429
प्रतिसाद वेळ (सरासरी)
111.94s
एकूण खर्च
$0.981
शिफारस केलेले मॉडेल GPT-5.2 Chat

It has the best score here (8.0), while costing about 1.6x less than Qwen3.5-27B (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none प्रकाशन: 2025-12-11 Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24
स्कोअर 8.0 7.4
क्रमांक #37 #67
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 74.2% 72.7%
अस्थिर चाचण्या 4 5
एकूण रन 66 66
प्रति निकाल खर्च 4.308 8.324
एकूण खर्च $0.604 $0.981
इनपुट किंमत $1.750 / 1M $0.195 / 1M
आउटपुट किंमत $14.000 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 101,248 111,635
आउटपुट टोकन्स 30,424 15,999
रिझनिंग टोकन्स 0 598,430
प्रतिसाद वेळ (सरासरी) 7.65s 111.94s
प्रतिसाद वेळ (कमाल) 38.52s 1026.43s
प्रतिसाद वेळ (एकूण) 168.39s 2462.67s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
खर्च
$0.010
वेळ
15.3s
टोकन्स
797 tok

#67 Qwen3.5-27B

medium
खर्च
$0.008
वेळ
62.0s
टोकन्स
3,099 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

झटपट तुलना

तुलना जोडी बदला