नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs OpenAI: GPT-5.5

GPT-5.5 average score मध्ये पुढे आहे: 6.9 vs 6.7. LongCat 2.0 (low) चा benchmark खर्च कमी आहे: $0.391 vs $0.544. GPT-5.5 वेगवान आहे: 2.36s vs 100.31s, pass rates 53.0% vs 56.1%.

शिफारस केलेले मॉडेलGPT-5.5It has the best score here (6.9), while responding about 42.5x faster than LongCat 2.0 (low).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-20

मेट्रिक LongCat 2.0 LongCat 2.0 low प्रकाशन: 2026-07-20 GPT-5.5 GPT-5.5 none प्रकाशन: 2026-04-24
स्कोअर 6.7 6.9
क्रमांक #91 #87
विश्वसनीयता 9.6 10.0
सुसंगतता 8.9 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 56.1%
अस्थिर चाचण्या 3 3
एकूण रन 66 66
प्रति निकाल खर्च 3.910 4.945
एकूण खर्च $0.391 $0.544
इनपुट किंमत $0.300 / 1M $5.000 / 1M
आउटपुट किंमत $1.200 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 90,909 79,285
आउटपुट टोकन्स 5,679 4,915
रिझनिंग टोकन्स 297,369 0
प्रतिसाद वेळ (सरासरी) 100.31s 2.36s
प्रतिसाद वेळ (कमाल) 560.39s 12.24s
प्रतिसाद वेळ (एकूण) 2206.82s 51.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 LongCat 2.0

low
खर्च
$0.024
वेळ
428.0s
टोकन्स
19,557 tok

#87 GPT-5.5

none
खर्च
$0.090
वेळ
54.3s
टोकन्स
3,063 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

झटपट तुलना

तुलना जोडी बदला